Serie Junior · el más chiqui de Xeretron

Xeretron Junior E4B

El modelo más chiqui de la familia. Basado en Gemma 4 E4B (google/gemma-4-E4B-it). Perfecto para conversaciones casuales, lectura de documentos y agentes pequeños. Es el modelo base con el que puedes compartir IA real a toda la empresa a bajo costo: responde emails y se conecta con XMail para contestar correos, controlar la agenda y más. Hasta 290 t/s (dependiendo de GPU).

Conversaciones Documentos Agentes chicos XMail 290 t/s · según GPU
Quiero Junior en mi nodo Ver bondades
290 t/s hasta · según GPU
E4B~4.5B efectivos
128Kcontexto
XMailcorreos · agenda
Audionativo · edge
Apache2.0

E4B = ~4.5B parámetros efectivos (~8B con embeddings / PLE). Specs de la model card de Gemma 4. Junior es el finetune Xeretron sobre esa base para el día a día empresarial.

Bondades Junior

Chiqui en tamaño. Grande en cobertura.

No necesita un rack entero: alcanza para que toda la empresa hable con IA de verdad.

Conversaciones casuales

Chat diario, tono natural, respuestas rápidas. Ideal para asistencia general sin gastar el “cerebro grande” en cada pregunta.

Lectura de documentos

PDF, pantallas, OCR y comprensión visual (Gemma 4 multimodal). Resume, extrae y responde sobre documentos del trabajo.

Agentes pequeños

Function calling nativo para micro-agentes: tickets, FAQs, flujos cortos y herramientas del panel — sin orquestar una flota Frontier.

IA para toda la empresa

El modelo base para compartir inteligencia real a bajo costo: más usuarios concurrentes, menos VRAM, mismo nodo Xeretron.

Emails con XMail

Se conecta con XMail para contestar correos con tu tono, priorizar lo urgente y no mandar la bandeja a una nube de terceros.

Agenda bajo control

Con XMail: armar el día, recordar citas y gestionar la agenda desde el mismo asistente que responde el correo.

Base · Gemma 4 E4B

Edge-ready. Multimodal. Apache 2.0.

Pesos open vía google/gemma-4-E4B-it (Google DeepMind). Pensado para laptop y servidor ligero: texto, imagen y audio nativo, contexto 128K, reasoning configurable.

~4.5B efectivos · PLE

Per-Layer Embeddings: tablas grandes para lookups rápidos; el compute activo se mantiene chico. Más inteligencia por watt en el nodo.

Texto · imagen · audio

Documentos, pantallas, charts y audio (ASR / traducción). Ideal para bandeja de entrada y adjuntos del día a día.

Tools & agentes

Function calling nativo + system prompt: Junior se enchufa a XMail, MCPs ligeros y flujos empresariales cortos.

Apache 2.0

Uso comercial limpio: finetune, redistribución y despliegue en nodo con NOTICE — sin Gemma Terms de generaciones anteriores.

Referencia de la base

Números públicos Gemma 4 E4B.

Cifras de la model card (instruction-tuned). Junior hereda esta base y la especializa al ecosistema Xeretron + XMail.

Benchmark Gemma 3 27B Gemma 4 E4B (base Junior)
MMLU Pro67.6%69.4%
LiveCodeBench v629.1%52.0%
GPQA Diamond42.4%58.6%
Tau2 (avg)16.2%42.2%
MMMU Pro49.7%52.6%
MATH-Vision46.0%59.5%
OmniDocBench 1.5 ↓0.3650.181

Fuente: model card Gemma 4 E4B-it / Google DeepMind. ↓ = menor es mejor. Junior no sustituye una evaluación en tu hardware.

Especificaciones

Ficha técnica Junior.

AtributoDetalle
NombreXeretron Junior E4B
BaseGemma 4 E4B-it · google/gemma-4-E4B-it
Parámetros~4.5B efectivos · ~8B con embeddings (PLE) · 42 capas
Contexto128K tokens
ModalidadesTexto · imagen · audio · tool / agentes
Especialidad XeretronEmpresa a bajo costo · chat · docs · XMail · agenda · agentes pequeños
ThroughputHasta ~290 t/s (dependiendo de GPU)
Licencia baseApache 2.0 — LICENSE / NOTICE

Licencia · Apache 2.0

LICENSE Apache 2.0 NOTICE Junior

En tu nodo

Cabe donde los grandes no caben.

Junior está pensado para correr ligero: más puestos, más conversaciones, menos GPU. Combínalo con XMail y deja Omega/Titan/Developer para cuando el trabajo lo pida.

  • Ideal como default empresarial en el panel.
  • XMail: correos + agenda en el mismo nodo.
  • API OpenAI-compatible para apps internas.
  • Escala usuarios sin multiplicar el hardware.

Stack recomendado

  • GPU consumer o edge · cuantización ligera
  • Perfil Junior + XMail en el panel
  • Agentes pequeños / FAQs / inbox
  • Sube a Developer/Turbo/Titan/Omega cuando haga falta

Siguiente paso

Pon IA real en cada escritorio.

Junior para el día a día y XMail. Los cerebros grandes, cuando el problema lo merezca.