Conversaciones casuales
Chat diario, tono natural, respuestas rápidas. Ideal para asistencia general sin gastar el “cerebro grande” en cada pregunta.
Serie Junior · el más chiqui de Xeretron
El modelo más chiqui de la familia. Basado en Gemma 4 E4B (google/gemma-4-E4B-it). Perfecto para conversaciones casuales, lectura de documentos y agentes pequeños. Es el modelo base con el que puedes compartir IA real a toda la empresa a bajo costo: responde emails y se conecta con XMail para contestar correos, controlar la agenda y más. Hasta 290 t/s (dependiendo de GPU).
E4B = ~4.5B parámetros efectivos (~8B con embeddings / PLE). Specs de la model card de Gemma 4. Junior es el finetune Xeretron sobre esa base para el día a día empresarial.
Bondades Junior
No necesita un rack entero: alcanza para que toda la empresa hable con IA de verdad.
Chat diario, tono natural, respuestas rápidas. Ideal para asistencia general sin gastar el “cerebro grande” en cada pregunta.
PDF, pantallas, OCR y comprensión visual (Gemma 4 multimodal). Resume, extrae y responde sobre documentos del trabajo.
Function calling nativo para micro-agentes: tickets, FAQs, flujos cortos y herramientas del panel — sin orquestar una flota Frontier.
El modelo base para compartir inteligencia real a bajo costo: más usuarios concurrentes, menos VRAM, mismo nodo Xeretron.
Se conecta con XMail para contestar correos con tu tono, priorizar lo urgente y no mandar la bandeja a una nube de terceros.
Con XMail: armar el día, recordar citas y gestionar la agenda desde el mismo asistente que responde el correo.
Base · Gemma 4 E4B
Pesos open vía google/gemma-4-E4B-it (Google DeepMind). Pensado para laptop y servidor ligero: texto, imagen y audio nativo, contexto 128K, reasoning configurable.
Per-Layer Embeddings: tablas grandes para lookups rápidos; el compute activo se mantiene chico. Más inteligencia por watt en el nodo.
Documentos, pantallas, charts y audio (ASR / traducción). Ideal para bandeja de entrada y adjuntos del día a día.
Function calling nativo + system prompt: Junior se enchufa a XMail, MCPs ligeros y flujos empresariales cortos.
Uso comercial limpio: finetune, redistribución y despliegue en nodo con NOTICE — sin Gemma Terms de generaciones anteriores.
Referencia de la base
Cifras de la model card (instruction-tuned). Junior hereda esta base y la especializa al ecosistema Xeretron + XMail.
| Benchmark | Gemma 3 27B | Gemma 4 E4B (base Junior) |
|---|---|---|
| MMLU Pro | 67.6% | 69.4% |
| LiveCodeBench v6 | 29.1% | 52.0% |
| GPQA Diamond | 42.4% | 58.6% |
| Tau2 (avg) | 16.2% | 42.2% |
| MMMU Pro | 49.7% | 52.6% |
| MATH-Vision | 46.0% | 59.5% |
| OmniDocBench 1.5 ↓ | 0.365 | 0.181 |
Fuente: model card Gemma 4 E4B-it / Google DeepMind. ↓ = menor es mejor. Junior no sustituye una evaluación en tu hardware.
Especificaciones
| Atributo | Detalle |
|---|---|
| Nombre | Xeretron Junior E4B |
| Base | Gemma 4 E4B-it · google/gemma-4-E4B-it |
| Parámetros | ~4.5B efectivos · ~8B con embeddings (PLE) · 42 capas |
| Contexto | 128K tokens |
| Modalidades | Texto · imagen · audio · tool / agentes |
| Especialidad Xeretron | Empresa a bajo costo · chat · docs · XMail · agenda · agentes pequeños |
| Throughput | Hasta ~290 t/s (dependiendo de GPU) |
| Licencia base | Apache 2.0 — LICENSE / NOTICE |
Licencia · Apache 2.0
En tu nodo
Junior está pensado para correr ligero: más puestos, más conversaciones, menos GPU. Combínalo con XMail y deja Omega/Titan/Developer para cuando el trabajo lo pida.
Siguiente paso
Junior para el día a día y XMail. Los cerebros grandes, cuando el problema lo merezca.