Arquitectura híbrida
64 capas en patrón 3:1 — Gated DeltaNet (atención lineal) + Gated Attention completa. Hidden size 5120, FFN 17408. Densidad real en cada token.
Modelos · Serie Developer
Modelo basado en Qwen3.8-27B y finetuneado para el ecosistema Xeretron: CodiiX (nuestro IDE para vibe coders), arquitecturas, apps y agentes. La misma calidad que buscas en proveedores cloud — con el poder de lo local, en tu nodo personal.
Para qué existe
Xeretron Developer 27B no es un chat genérico empaquetado. Es el cerebro de trabajo del ecosistema: entiende repositorios, diseña sistemas, orquesta agentes y responde con la profundidad que hoy asocias a APIs de pago — sin enviar tu código a terceros.
Refactor, generación de features, tests y navegación de repos con el modelo en tu máquina.
Diagramas mentales convertidos en módulos, contratos de API y decisiones técnicas trazables.
Planificación multi-paso, tool calling y bucles de ejecución fiables en entorno local.
Documentos, análisis, investigación y tareas de oficina de largo horizonte en el mismo nodo.
En acción · CodiiX
Captura real: agente CodiiX con el modelo xeretron-developer-27b cargado, explorando el repo y aplicando cambios — sin tokens de terceros.
Base abierta · Qwen3.8-27B
Qwen3.8-27B (Alibaba / Qwen) es un modelo denso multimodal de 27B parámetros, con arquitectura híbrida Gated DeltaNet + atención, Multi-Token Prediction y control flexible de razonamiento. Destaca en coding agentico, trabajo profesional y tareas de largo horizonte — el punto de partida ideal para un finetune Developer.
64 capas en patrón 3:1 — Gated DeltaNet (atención lineal) + Gated Attention completa. Hidden size 5120, FFN 17408. Densidad real en cada token.
Modo thinking por defecto, con reasoning_effort (xhigh / medium / low) y preserve_thinking para agentes multi-turno.
Encoder visual integrado: diagramas, capturas de UI, documentos y video. Ideal para CodiiX cuando el contexto es una pantalla, no solo un archivo.
Parsers oficiales para herramientas y coding harnesses (vLLM / SGLang). Listo para bucles de agente con feedback del entorno.
Multi-Token Prediction entrenado en varios pasos: más throughput en inferencia local cuando el runtime lo aprovecha.
Compatible con Transformers, vLLM, SGLang y runtimes GGUF del nodo Xeretron. Pesos open; operación bajo tu control.
Finetune Xeretron
Sobre Qwen3.8 afinamos el comportamiento para que hable el idioma de Xeretron: paneles, lanes, perfiles de modelo, APIs OpenAI-compatibles, CodiiX y flujos de vibe coding reales — no demos de laboratorio.
Especialización
Developer 27B está sesgado a propósito hacia el trabajo que más duele cuando pagas por token.
Generación a nivel repo, refactors, debugging, tests y terminal agentica. La base Qwen3.8 ya marca fuerte en SWE-bench Pro, Terminal Bench y coding competitivo; el finetune empuja ese músculo hacia CodiiX y tu stack.
De requisitos a módulos: límites de servicio, contratos, datos, seguridad y despliegue. Menos “código suelto”, más sistemas que se pueden operar.
Planificación, tool calling, feedback del entorno y tareas de largo horizonte. Pensado para bucles que terminan el trabajo, no solo el siguiente párrafo.
Oficina y conocimiento: documentos, investigación, análisis y flujos multi-paso. La misma GPU que programa también trabaja el resto del día.
Referencia de la base · Qwen3.8-27B
Cifras reportadas por Qwen en la model card de Qwen3.8-27B. Xeretron Developer 27B hereda esta base y la especializa; los scores de finetune se publican al cerrar cada evaluación interna.
| Benchmark | Área | Qwen3.8-27B |
|---|---|---|
| SWE-bench Pro | Coding agentico | 61.7 |
| Terminal Bench 2.1 | Terminal agentica | 73.0 |
| QwenSWEBench | Software engineering | 79.0 |
| LiveCodeBench v6 | Coding competitivo | 90.3 |
| NL2Repo-Bench | Repo-level codegen | 42.3 |
| CoWorkBench | Work de largo horizonte | 70.7 |
| GPQA Diamond | Razonamiento científico | 89.2 |
| IFBench | Seguimiento de instrucciones | 79.5 |
| OSWorld-Verified | Uso de computador | 84.3 |
| OmniDocBench 1.5 | Documentos / visión | 91.1 |
Fuente: model card pública de Qwen/Qwen3.8-27B. Los harnesses y protocolos son los declarados por el autor del modelo. Developer 27B no sustituye una evaluación en tu hardware: medimos latencia y calidad en el nodo real durante el onboarding.
Especificaciones
| Atributo | Detalle |
|---|---|
| Nombre | Xeretron Developer 27B |
| Base | Qwen3.8-27B (dense VLM · Apache 2.0 en la línea open del autor) |
| Parámetros | 27B densos activos |
| Capas | 64 · layout 16 × (3 × DeltaNet→FFN + 1 × Attention→FFN) |
| Hidden / FFN | 5120 / 17408 |
| Vocabulario | ~248K tokens (padded) |
| Contexto | 262.144 nativo · hasta ~1.000.000 con YaRN / rope scaling |
| Modalidades | Texto + visión (imágenes / video) · tool calling |
| Especialidad | Work · Programación · Agentes · Arquitectura |
| Runtime Xeretron | Panel + lanes GPU · API OpenAI-compatible · CodiiX |
| Despliegue | Nodos personales y de equipo (GPU NVIDIA / CUDA) |
Nodos personales
La familia 27B densa de Qwen3.8 está pensada para ser deployment-friendly: con cuantización (p. ej. FP8 / GGUF) corre en estaciones de trabajo y servidores de una o pocas GPU. El nodo Xeretron dimensiona VRAM, contexto y concurrencia contigo — sin promesas mágicas.
Carga el perfil Developer, publica el endpoint interno y apunta CodiiX al nodo. Métricas de primer token, tok/s y salud del modelo en la misma pantalla que el resto del stack.
Ecosistema
IDE para vibe coders conectado al modelo local: itera sin miedo al contador de tokens.
Prueba en el panel o consume desde tus apps con claves de alcance limitado.
Código, prompts y documentos se quedan en tu infraestructura. Sin alquiler eterno de inteligencia.
Siguiente paso
Evaluamos tu GPU, el contexto que necesitas y el flujo CodiiX. Si el hardware no alcanza, te lo decimos antes de instalar.