Bugs infernales
Heisenbugs, condiciones de carrera, estados imposibles, refactors que rompen en el borde. Titan sostiene el hilo hasta el root cause y el fix verificable.
Serie Titan · Flagship de perfección
El rey de la perfección. Basado en Qwen3.8-Flash-Next — preview de la arquitectura rumbo a Qwen4 — y finetuneado por Xeretron. Inteligencia multiplicada frente al 27B: resuelve bugs infernales, controla MCPs con precisión, crea y manipula canvas y objetos 3D, y entrega desarrollos y landings con acabado fino.
*Posicionamiento de producto Xeretron: profundidad y calidad de acabado percibidas frente a Developer 27B en tareas complejas (bugs, agentes, UI). No es un score de un bench único.
Bondades Titan
No es “otro chat más grande”. Es el modelo que cierra el trabajo con calidad de producto.
Heisenbugs, condiciones de carrera, estados imposibles, refactors que rompen en el borde. Titan sostiene el hilo hasta el root cause y el fix verificable.
Hereda el control reasoning_effort: low, medium, xhigh. Escalas pensamiento según el ticket — no quemas profundidad cuando no hace falta.
Creación y manipulación de canvas, layouts interactivos y objetos 3D: ideación visual que se convierte en artefacto, no en párrafo.
Tool calling y orquestación de MCP con disciplina: menos loops rotos, más llamadas correctas al servidor correcto, en el orden correcto.
Desarrollos que llegan al borde: estados vacíos, errores, tipografía, responsivo, accesibilidad básica y “detalle de producto”, no solo el happy path.
Landing pages con atmósfera, jerarquía y micro-detalle. El tipo de UI que se siente diseñada, no generada a medias.
Developer 27B · precisión densa
Titan 125B · rey de la perfección
Base · Qwen3.8-Flash-Next
Publicado como pesos open en la línea unsloth/Qwen3.8-Flash-Next (familia Qwen). No es “más de lo mismo”: introduce Qwen Sparse Attention, Gated Residual y N-gram Embedding para escalar inteligencia con eficiencia.
Atención a nivel de micro-bloques (no token a token). Menos latencia en contextos largos — crítico para agentes y sesiones de debug profundas.
Residuales con gates de lectura/escritura: más expresividad entre capas sin inflar el costo de inferencia.
Eje de parámetros offloadeable: escala capacidad sin el costo compute de un MoE equivalente. Ideal para nodos con memoria ajustada.
10 routed + 1 shared activos · ~6B por token. MTP multi-step para empujar throughput cuando el runtime lo habilita.
Referencia de la base
Cifras de la model card de Qwen3.8-Flash-Next. Titan hereda esta base y la especializa al ecosistema Xeretron; los t/s locales son mediciones propias.
| Benchmark | Qwen3.8-27B | Flash-Next (base Titan) |
|---|---|---|
| DeepSWE 1.1 | 42.2 | 58.7 |
| SWE-bench Pro | 61.7 | 62.5 |
| SWE-bench Multilingual | 73.8 | 81.0 |
| JobBench | 33.4 | 55.7 |
| Toolathlon Verified | 67.1 | 73.5 |
| GPQA Diamond | 89.2 | 91.7 |
| LiveCodeBench v6 | 90.3 | 91.9 |
| Vision2Web | 62.9 | 64.0 |
| ClawEval-MM Pass@3 | 57.4 | 64.4 |
Fuente: model card pública de Qwen3.8-Flash-Next / Unsloth. Los harnesses son los declarados por el autor. Titan no sustituye una evaluación en tu hardware: medimos calidad y tok/s en el nodo real.
Especificaciones
| Atributo | Detalle |
|---|---|
| Nombre | Xeretron Titan 125B |
| Base | Qwen3.8-Flash-Next · unsloth/Qwen3.8-Flash-Next |
| Parámetros | 125B backbone · ~6B activos · +51B n-gram · +MTP (~4B) |
| Capas / MoE | 48 capas · 512 experts · 10 routed + 1 shared |
| Arquitectura | Gated DeltaNet + Qwen Sparse Attention · Gated Residual |
| Contexto | 262.144 nativo · hasta ~1.000.000 (YaRN) |
| Modalidades | Texto · imagen · video · tool / MCP |
| Inteligencia | 3 niveles: low · medium · xhigh (reasoning_effort) |
| Especialidad Xeretron | Perfección de producto · bugs · canvas/3D · MCP · landings |
| Throughput local | Hasta ~40 t/s en 2× RTX 3090 (medición Xeretron; varía por cuantización/contexto) |
| Licencia base | Qwen Community License 1.0 — ver salvedad de distribución |
Licencia · Qwen Community 1.0
Cumpliendo con la Qwen Community License 1.0 del modelo base (Qwen3.8-Flash-Next), Xeretron Titan 125B se comparte para el uso que el usuario quiera darle dentro de su nodo Xeretron. No cobramos por el modelo: lo que se evalúa o contrata es la infraestructura, el panel y el acompañamiento — no una licencia de pesos Titan.
En tu nodo
Lo tenemos operando en infraestructura real: hasta 40 tokens/s con 2× RTX 3090. El nodo Xeretron dimensiona cuantización, contexto y lanes para que Titan sea usable — no solo “cargable”.
Siguiente paso
Titan para cuando el entregable no puede verse “casi listo”. Turbo cuando necesitas velocidad. Developer cuando iteras todo el día en CodiiX.
El modelo se comparte bajo Qwen Community License 1.0 para el uso que el usuario quiera en su nodo; no cobramos por Titan. Salvedad de licencia.