Modelos · Serie Developer

Xeretron Developer 27B

Modelo basado en Qwen3.8-27B y finetuneado para el ecosistema Xeretron: CodiiX (nuestro IDE para vibe coders), arquitecturas, apps y agentes. La misma calidad que buscas en proveedores cloud — con el poder de lo local, en tu nodo personal.

Work Programación Agentes Arquitectura Nodos personales
Probar en mi nodo Ver especificaciones
70 t/s hasta · según GPU
27Bparámetros densos
262Kcontexto nativo
1Mcontexto extendido
64capas híbridas
VLvisión + texto

Para qué existe

Un motor de desarrollo que vive contigo.

Xeretron Developer 27B no es un chat genérico empaquetado. Es el cerebro de trabajo del ecosistema: entiende repositorios, diseña sistemas, orquesta agentes y responde con la profundidad que hoy asocias a APIs de pago — sin enviar tu código a terceros.

  • Integrado con CodiiX, el IDE Xeretron para vibe coding.
  • Pensado para arquitecturas, apps completas y flujos agenticos.
  • Corre en nodos personales o de equipo: tu GPU, tu red, tu política.
  • Open weights de base + finetune Xeretron para el stack completo.

CodiiX

Refactor, generación de features, tests y navegación de repos con el modelo en tu máquina.

Arquitectura

Diagramas mentales convertidos en módulos, contratos de API y decisiones técnicas trazables.

Agentes

Planificación multi-paso, tool calling y bucles de ejecución fiables en entorno local.

Work

Documentos, análisis, investigación y tareas de oficina de largo horizonte en el mismo nodo.

En acción · CodiiX

Developer 27B dentro del IDE.

Captura real: agente CodiiX con el modelo xeretron-developer-27b cargado, explorando el repo y aplicando cambios — sin tokens de terceros.

CodiiX con Xeretron Developer 27B: explorador, editor y panel de agente sobre un proyecto real
Clic para ampliar

Base abierta · Qwen3.8-27B

Partimos de uno de los densos open más capaces.

Qwen3.8-27B (Alibaba / Qwen) es un modelo denso multimodal de 27B parámetros, con arquitectura híbrida Gated DeltaNet + atención, Multi-Token Prediction y control flexible de razonamiento. Destaca en coding agentico, trabajo profesional y tareas de largo horizonte — el punto de partida ideal para un finetune Developer.

Arquitectura híbrida

64 capas en patrón 3:1 — Gated DeltaNet (atención lineal) + Gated Attention completa. Hidden size 5120, FFN 17408. Densidad real en cada token.

Thinking control

Modo thinking por defecto, con reasoning_effort (xhigh / medium / low) y preserve_thinking para agentes multi-turno.

Visión nativa

Encoder visual integrado: diagramas, capturas de UI, documentos y video. Ideal para CodiiX cuando el contexto es una pantalla, no solo un archivo.

Tool calling

Parsers oficiales para herramientas y coding harnesses (vLLM / SGLang). Listo para bucles de agente con feedback del entorno.

MTP

Multi-Token Prediction entrenado en varios pasos: más throughput en inferencia local cuando el runtime lo aprovecha.

Despliegue local

Compatible con Transformers, vLLM, SGLang y runtimes GGUF del nodo Xeretron. Pesos open; operación bajo tu control.

Finetune Xeretron

De base abierta a cerebro del ecosistema.

Sobre Qwen3.8 afinamos el comportamiento para que hable el idioma de Xeretron: paneles, lanes, perfiles de modelo, APIs OpenAI-compatibles, CodiiX y flujos de vibe coding reales — no demos de laboratorio.

Qué aporta el finetune

  • Preferencia por soluciones accionables en CodiiX y el panel.
  • Mejor alineación con agentes, tool use y arquitectura de software.
  • Estilo de trabajo para LatAm: español técnico claro, sin perder inglés de código.
  • Enfoque Work + Programación: del ticket al PR, del brief a la app.
  • Optimizado para correr en nodos personales, no solo en clusters.

Especialización

Cuatro frentes. Un solo modelo.

Developer 27B está sesgado a propósito hacia el trabajo que más duele cuando pagas por token.

Programación

Generación a nivel repo, refactors, debugging, tests y terminal agentica. La base Qwen3.8 ya marca fuerte en SWE-bench Pro, Terminal Bench y coding competitivo; el finetune empuja ese músculo hacia CodiiX y tu stack.

Arquitectura

De requisitos a módulos: límites de servicio, contratos, datos, seguridad y despliegue. Menos “código suelto”, más sistemas que se pueden operar.

Agentes

Planificación, tool calling, feedback del entorno y tareas de largo horizonte. Pensado para bucles que terminan el trabajo, no solo el siguiente párrafo.

Work

Oficina y conocimiento: documentos, investigación, análisis y flujos multi-paso. La misma GPU que programa también trabaja el resto del día.

Referencia de la base · Qwen3.8-27B

Números públicos del modelo original.

Cifras reportadas por Qwen en la model card de Qwen3.8-27B. Xeretron Developer 27B hereda esta base y la especializa; los scores de finetune se publican al cerrar cada evaluación interna.

Benchmark Área Qwen3.8-27B
SWE-bench ProCoding agentico61.7
Terminal Bench 2.1Terminal agentica73.0
QwenSWEBenchSoftware engineering79.0
LiveCodeBench v6Coding competitivo90.3
NL2Repo-BenchRepo-level codegen42.3
CoWorkBenchWork de largo horizonte70.7
GPQA DiamondRazonamiento científico89.2
IFBenchSeguimiento de instrucciones79.5
OSWorld-VerifiedUso de computador84.3
OmniDocBench 1.5Documentos / visión91.1

Fuente: model card pública de Qwen/Qwen3.8-27B. Los harnesses y protocolos son los declarados por el autor del modelo. Developer 27B no sustituye una evaluación en tu hardware: medimos latencia y calidad en el nodo real durante el onboarding.

Especificaciones

Ficha técnica.

AtributoDetalle
NombreXeretron Developer 27B
BaseQwen3.8-27B (dense VLM · Apache 2.0 en la línea open del autor)
Parámetros27B densos activos
Capas64 · layout 16 × (3 × DeltaNet→FFN + 1 × Attention→FFN)
Hidden / FFN5120 / 17408
Vocabulario~248K tokens (padded)
Contexto262.144 nativo · hasta ~1.000.000 con YaRN / rope scaling
ModalidadesTexto + visión (imágenes / video) · tool calling
EspecialidadWork · Programación · Agentes · Arquitectura
Runtime XeretronPanel + lanes GPU · API OpenAI-compatible · CodiiX
DespliegueNodos personales y de equipo (GPU NVIDIA / CUDA)

Nodos personales

Cabe en hardware real, no solo en slides.

La familia 27B densa de Qwen3.8 está pensada para ser deployment-friendly: con cuantización (p. ej. FP8 / GGUF) corre en estaciones de trabajo y servidores de una o pocas GPU. El nodo Xeretron dimensiona VRAM, contexto y concurrencia contigo — sin promesas mágicas.

  • Orientativo: GPU de consumo alto / workstation con VRAM suficiente para el cuantizado elegido.
  • Contexto largo (128K+) recomendado para preservar thinking en tareas complejas.
  • Lanes del panel para aislar chat, agentes CodiiX y cargas de fondo.
  • Offline con pesos instalados; actualizaciones cuando tú lo decidas.

En el panel Xeretron

Carga el perfil Developer, publica el endpoint interno y apunta CodiiX al nodo. Métricas de primer token, tok/s y salud del modelo en la misma pantalla que el resto del stack.

Ecosistema

No es solo un peso. Es una forma de trabajar.

CodiiX

IDE para vibe coders conectado al modelo local: itera sin miedo al contador de tokens.

Chat y APIs

Prueba en el panel o consume desde tus apps con claves de alcance limitado.

Privacidad

Código, prompts y documentos se quedan en tu infraestructura. Sin alquiler eterno de inteligencia.

Siguiente paso

Pon Developer 27B en tu nodo.

Evaluamos tu GPU, el contexto que necesitas y el flujo CodiiX. Si el hardware no alcanza, te lo decimos antes de instalar.