Xeretron AI Server · Tu IA privada, en tu propio entorno

Tu propia inteligencia artificial, en tu equipo o servidor.

SIN tokens · SIN límites · TODO tuyo

Xeretron instala modelos, voz, documentos, APIs y operación de IA donde tú decidas: tu equipo, tu servidor o el de tu empresa. Tus datos permanecen bajo tu control, ya sea para uso personal, un equipo pequeño o toda una organización.

  • Sin tokens ni cuotas de uso
  • Para personas, equipos y empresas
  • Modelos propios Xeretron
  • En tu equipo o servidor
  • Diseñado para crecer contigo
  • Modelos de texto y visión
  • Voz a texto
  • OCR y documentos
  • Texto a voz
  • API para aplicaciones
  • Operación multi-GPU

El cambio de paradigma

De alquilar respuestas a construir tu propio nodo de IA.

La IA moderna se vende como un contador de tokens en la nube. Xeretron propone otra relación: tu IA privada corriendo en tu propio entorno, lejos de ser un servicio distante que se alquila por petición, se convierte en una capacidad que es tuya — para ti, tu equipo o tu organización.

Comparación entre IA en la nube por tokens y tu IA privada con Xeretron
Dimensión IA en la nube por tokens Tu IA privada con Xeretron
Recorrido de los datosCada solicitud viaja fuera de tu controlProcesamiento en tu propio entorno
Estructura de costoCosto variable por consumoCapacidad instalada, costo más predecible
ModelosDependencia de proveedorElección y control de modelos
Gobierno de la informaciónDatos sujetos a políticas externasGobierno local de información
ConectividadInternet como requisito centralFunciona en tu equipo o servidor, incluso sin internet

Xeretron no pretende eliminar la nube pública. Permite decidir qué cargas deben permanecer privadas en tu entorno y dónde tiene sentido combinar ambos mundos consumiendo modelos gigantes con proveedores externos de inferencia.

15 s
Para entender el producto
Días
A la primera inferencia
0
Interacciones obligatorias con terceros
ES/EN/PT
Interfaz y documentación

Qué es Xeretron

Un sistema operativo práctico para la IA privada.

No es un chat con otro logo: es un sistema que reúne modelos, hardware, seguridad y servicios en un solo lugar — del equipo de una persona al servidor de una empresa.

Modelos bajo tu control

GGUF de texto y visión con carga, descarga y perfiles administrados desde el propio nodo.

Hardware visible

GPU, CPU, RAM, temperatura y energía en un HUD claro: sabes qué está ocurriendo en tiempo real.

IA multimodal

Chat, imágenes, voz a texto, documentos y audio generados en el mismo ecosistema local.

APIs para construir

Endpoints compatibles con el formato OpenAI más servicios propios para integrar tus aplicaciones.

Usuarios y seguridad

Autenticación, MFA, API keys con alcance limitado y auditoría de accesos e inferencias.

Operación real

Multi-GPU, red, firewall, servicios y energía gestionados desde la misma interfaz.

El producto, por dentro

Sabe qué está ocurriendo.

Qué modelo está cargado, dónde corre, cuánto consume y si los servicios están saludables. Cada pantalla del panel existe para que cualquier persona o equipo pueda operar su propia IA sin ser expertos en ingeniería.

  • Dashboard y HUD de hardware con telemetría del nodo.
  • Catálogo de modelos con carga, descarga y perfiles publicados.
  • Chat con streaming, adjuntos visuales y métricas de inferencia.
  • Voz a texto, OCR de documentos y texto a voz en el mismo flujo.
  • Usuarios, roles, claves y auditoría en un solo lugar.
Explorar el producto
Captura real del panel Xeretron: catálogo de modelos y stack de inferencia
Clic para ampliar

Capacidades

Mucho más que un chat.

Un conjunto de motores especializados que comparten un mismo panel, una misma política de seguridad y una misma infraestructura.

Inferencia LLM

Texto y visión con streaming, perfiles, carga/descarga, lanes, stacks, modo frontier y métricas.

Voz a texto

Transcripción local con Whisper y descarga por inactividad para liberar GPU cuando no se usa.

Documentos y OCR

PDF, Office, imágenes y hojas de cálculo convertidas a texto en español e inglés.

Texto a voz

Generación de audio bajo demanda dentro del nodo, sin enviar el contenido a servicios externos.

Plataforma

APIs, MCP/Unreal, telefonía SIP, Sync e híbrido explícito.

Gobierno

Usuarios de sistema y de aplicaciones, PAM, MFA, claves con alcance, auditoría y red.

Infraestructura

Multi-GPU, firewall, servicios y consumo energético administrados desde el panel.

Multi-idioma

Interfaz y documentación en español, inglés y portugués, listas para equipos diversos.

Soluciones

Para personas, equipos e instituciones que responden por sus datos.

Desde tu propio equipo hasta una organización completa: cada contexto tiene su propio lenguaje y sus propios límites. Xeretron se adapta a cada uno.

Educación

Una IA que fortalece la institución, no que extrae su conocimiento: asistentes académicos, consultas de reglamentos, transcripción de clases, accesibilidad y apoyo docente.

Ver casos

Universidades e investigación

Experimentar modelos propios Xeretron y cuantizaciones, construir aplicaciones sin costo variable por prueba, cuidar datasets en el campus y formar talento en infraestructura real.

Ver casos

Salud

IA cerca de los equipos que cuidan personas, con casos administrativos y documentales. No sustituye el criterio médico ni es, por sí solo, un dispositivo médico.

Ver casos

Gobierno

La capacidad de IA de una institución pública también puede ser patrimonio público. Soberanía no significa aislamiento, y no afirmamos cumplimiento legal automático.

Ver casos

Personas

Tu IA privada en tu propio equipo: un asistente para escribir, estudiar y crear, con tus datos bajo tu control. Ideal para empezar con el plan Personal.

Ver casos

Equipos y empresas

Asistentes internos, procesamiento de documentos, automatización, voz y continuidad operativa ante cambios de proveedor o de precios. Del equipo pequeño a la organización completa.

Ver casos

Emprendedores y labs

Máxima flexibilidad de modelos y perfiles para prototipar productos con IA propia, sin que cada experimento se cobre por token.

Ver casos

Privacidad

Privacidad por arquitectura, no solo por promesa.

La confidencialidad no depende de una declaración de intenciones: depende de por dónde viajan los bytes, quién puede entrar y qué queda registrado. Xeretron se diseña alrededor de esos controles.

No prometemos sistemas «inviolables». Describimos controles concretos y los límites reales de cada despliegue, que se definen en la evaluación previa.

Seguridad y tecnología

Autenticación y MFA

Acceso con segundo factor y gestión de sesiones desde el propio nodo.

API keys con alcance

Cada integración recibe claves limitadas por permiso y por consumo.

Auditoría

Registros de seguridad y de inferencias para reconstruir qué ocurrió.

TLS y firewall

Exposición externa controlada, cifrado en tránsito y puertos administrados.

Economía

Cuando la IA se vuelve infraestructura, la conversación sobre costos cambia.

En la nube, el costo crece de forma lineal con tu uso — y no para. Con Xeretron en tu propio entorno, la conversación cambia: una inversión clara y un costo anual predecible, por pocos usuarios o por decenas.

  • Punto de equilibrio estimado: CAPEX ÷ (costo cloud mensual − operación mensual).
  • Perfil orientativo blended PYME: entrada ~$1,50 y salida ~$6,00 por millón de tokens.

Cómo funciona

Cuatro pasos, con acompañamiento real.

No entregamos un instalador y desaparecemos. Cada despliegue empieza con una evaluación y termina contigo — o con tu equipo — operando su IA con autonomía.

Evaluamos

Diagnóstico

Qué datos se procesarán, qué modelos necesitas, cuántos usuarios, qué hardware existe y qué disponibilidad esperas.

Instalamos

Despliegue

Preparación del nodo, CUDA y servicios, catálogo inicial de modelos y HTTPS sobre tu red.

Configuramos

Integración

Usuarios, roles, claves de API, conexiones con tus aplicaciones y capacitación del equipo responsable.

Acompañamos

Operación

Soporte de arranque, ajustes de rendimiento, actualizaciones acordadas e informe de resultados.

Primera inferencia en días, no en meses

Planes

Cuatro formas de empezar.

Del equipo personal a la organización: todos los planes incluyen instalación, capacitación y soporte de arranque. Usuario adicional en cualquier plan: $29 USD / año.

Personal

Para ti y hasta 3 usuarios

$599 USD por tiempo limitado

Precio normal: $1.299 USD

+ $299 / año · mantenimiento de la licencia y actualizaciones

  • 1 GPU en tu equipo o servidor
  • Hasta 3 modelos a tu elección
  • Hasta 3 usuarios por instalación
  • Panel unificado y API personal
  • Sin tokens ni cuotas de uso
Empezar con Personal

Institución

Colegios · ONGs · hasta 20 usuarios

$4.999 USD Instalación

+ $999 / año · mantenimiento de la licencia y actualizaciones

  • GPU dimensionada según evaluación
  • Hasta 20 usuarios por instalación
  • Modelos con visión y multi-usuario
  • Sincronización y auditoría
  • Programa de formación
Evaluar este plan

Empresa

Organizaciones · hasta 50 usuarios

$7.999 USD Instalación

+ $1.399 / año · mantenimiento de la licencia y actualizaciones

  • Arquitectura escalable con modo frontier
  • Hasta 50 usuarios por instalación
  • API keys por área con alcance limitado
  • Seguridad, auditoría y acuerdo de servicio
  • Integraciones con sistemas existentes
Evaluar este plan

Precios en USD, por instalación. Cada usuario adicional sobre el límite del plan se agrega a $29 USD / año. Licencia GPU adicional $99 / año. Los montos finales se confirman tras la evaluación de tu caso.

Voces del programa

Lo que dicen quienes ya operan su propio nodo.

Desarrolladores, equipos operativos y dueños de negocio que ya corren sus modelos en su propia infraestructura.

Antes pagaba por tokens cada vez que el modelo se trababa en un refactor grande. Ahora corro todo local con Xeretron: itero sin miedo, pruebo tres enfoques a la vez y el costo mensual es el mismo que el primer mes. Para vibe coding, la libertad de uso ilimitado cambia por completo el flujo.

Martín VegaIndie developer · vibe coder · México

Construimos un agente documental que lee contratos, extrae cláusulas clave y arma resúmenes en minutos. Antes, dos analistas tardaban una tarde en revisar un expediente. Con el nodo propio, los documentos sensibles nunca salen de nuestras redes y el volumen de papeleo creció sin contratar más gente.

Carolina RuizDirectora de operaciones · PYME legal · Colombia

Uso XMail para responder correos rutinarios y controlar mi agenda sin tocar el teléfono por las mañanas. El nodo responde con mi tono, prioriza lo urgente y me arma el día. Recuperé horas cada semana y, sobre todo, mis conversaciones comerciales no pasan por una nube de terceros.

Jorge RenteríaEmpresario · manufactura · Guatemala

Migramos la documentación técnica de producto al nodo: los ingenieros consultan manuales, fichas y protocolos con respuestas en segundos. Antes se perdía media jornada buscando el dato correcto. Hoy cada equipo responde solo y el conocimiento del área dejó de depender de una sola persona.

Laura PinedaGerente de ingeniería · sector industrial · Perú

Como estudiante de posgrado necesito experimentar sin que cada prueba me cueste una suscripción. Con el nodo propio pruebo y comparo modelos las 24 horas del día, y todo queda en mi servidor: mis datos académicos no se van a un proveedor externo ni aparecen en algún log ajeno.

Diego SalasDoctorante · ciencia de datos · Argentina

Como estudio jurídico pequeño no podíamos pagar un analista para revisar cada contrato. Hoy nuestro agente documental lee, clasifica y resuelve expedientes por la noche, y por la mañana el equipo solo revisa lo que importa. La inversión se pagó sola en dos meses, y nada de lo que firmamos sale de nuestra red.

Andrea MoralesSocia fundadora · estudio jurídico · Chile

Cada caso opera sobre infraestructura propia con modelos Xeretron. Los resultados varían según el plan, el hardware y el volumen de uso.

Programa de aliados

Cupos limitados para el programa de aliados de lanzamiento.

Despliegue acompañado, acceso cercano al equipo y participación directa en la evolución del producto. En esta etapa no es autoservicio: es tu IA privada, instalada y acompañada.

Historia

Estuvimos años construyendo Xeretron, haciendo lo difícil para que tú puedas imaginar y crear lo “imposible”.

Xeretron nace de una convicción simple: El mundo no debe limitarse a consumir inteligencia artificial gobernada desde otros lugares. No es un relato de fundadores; es el trabajo silencioso de hacer que un nodo funcione, todos los días, en condiciones reales.

Conoce a Xeretron

Pregunta estratégica

La pregunta ya no es «¿usamos IA?». Es: ¿de quién será esa IA?


  • Soberanía sin aislamiento: decides qué es local y qué es híbrido.
  • Potencia con límites claros: decimos qué puede y qué no puede hacer tu nodo.
  • Conocimiento que queda dentro de tu institución, tu lab o tu casa.

Preguntas frecuentes

Respuestas directas, sin letra pequeña.

¿Funciona sin Internet?

Los componentes locales funcionan si los modelos ya están instalados. Las descargas de modelos y las integraciones externas pueden requerir conectividad. Definimos qué queda offline en la evaluación de tu arquitectura.

¿Xeretron incluye los modelos?

Sí, Xeretron tiene modelos propios desde 4B hasta 552B y están disponibles de acuerdo a tu plan o puedes adquirirlos por separado, además puedes administrar y operar los modelos dentro del nodo. La selección concreta de modelos y sus licencias depende de tu caso de uso y se define en el proyecto.

¿Reemplaza la nube pública?

No necesariamente. Puede operar en modo privado o híbrido: tú decides qué cargas permanecen dentro y dónde conviene combinar ambos mundos.

¿Qué hardware necesito?

Depende de los modelos y de la concurrencia esperada. Por eso la evaluación previa es obligatoria: dimensionamos GPU, RAM y disco antes de proponerte una configuración.

¿Salen mis datos del servidor?

Los flujos locales pueden quedarse íntegramente dentro de tu red. Cualquier salida a un servicio externo ocurre solo si tú la habilitas explícitamente.

¿Xeretron decide por médicos, docentes o funcionarios?

No. Es infraestructura más supervisión humana: amplifica capacidad, no reemplaza el criterio profesional de quienes enseñan, investigan, cuidan o sirven.

Cómo entrenó Xerebria los modelos para Xeretron?

Usamos los mejores modelos de pesos abiertos y los fine tuneamos para que funcionen correctamente con todo nuestro ecosistema.

¿Cómo se instala?

Con despliegues acompañados en esta etapa inicial: diagnóstico, instalación, configuración, capacitación y soporte de arranque.

¿Puedo integrar mis aplicaciones?

Sí, mediante API compatible con el formato OpenAI y servicios propios, con claves de acceso limitadas por alcance, según el acuerdo del proyecto.

Siguiente paso

Tu IA privada puede correr en tu propio equipo, hoy.