Esta es Ari.

Un modelo de lenguaje de siete mil millones de parámetros que escribimos desde cero en NumPy, hecho para correr en la CPU de la misma máquina que ejecuta la cadena. Mantiene una conversación. Por diseño, eso es todo lo que hace.

Parámetros
7B
Escrita desde cero en
NumPy
Runtime en la CPU
INT4
Telemetría ni llamadas a la nube
Ninguna

Cómo la construimos

Siete mil millones de parámetros, escritos desde primeros principios.

Escribimos el modelo en NumPy y el motor que lo ejecuta, y entrenamos los pesos desde cero. Debajo no hay ninguna API de terceros ni ningún modelo base.

  1. Sin framework debajo

    La arquitectura está escrita en NumPy y no depende de PyTorch ni de una API alojada. No le afecta ninguna política externa ni ninguna deprecación.

  2. Siete mil millones de parámetros

    Es un modelo de 7B parámetros que entrenamos nosotros mismos, desde cero. Los pesos, la suite de evaluación y el pipeline de entrenamiento también son nuestros.

  3. Un motor de inferencia para la CPU

    El Xeris Inference Engine ejecuta todo el modelo en la CPU con un runtime de matrices propio, optimizado en INT4. La inferencia está limitada por el ancho de banda de memoria, así que el motor está afinado para DDR5 de doble canal.

  4. Instalada en el equipo

    Viene instalada de fábrica en el Xeris Computer junto a un nodo completo de Xeris y sirve inferencia por HTTP/RPC local. Los prompts se quedan en la máquina.

Qué hace

Su única función es la conversación.

Ari es un modelo solo de conversación. Le haces una pregunta y la responde. Por diseño no tiene herramientas, llaves ni autoridad, en la cadena ni en ningún otro sitio.

Lo que hace

  • Responder preguntas y mantener una conversación.
  • Correr en tu propio hardware, sin conexión si lo prefieres.
  • Mantener cada prompt en la máquina donde se escribió.

Lo que no hace

  • Guardar llaves ni firmar nada.
  • Mover fondos ni tocar la cadena.
  • Navegar por la web, llamar herramientas ni ejecutar código.

Ari y la cadena

La cadena ya tiene las reglas para un agente con autoridad.

La L1 de Xeris es todo lo que construimos. Ari es nuestro modelo, y por ahora corre junto a la cadena sin ningún papel en ella. Las reglas de la cadena para agentes se escribieron antes de que ella estuviera lista.

Hoy las dos solo comparten una máquina. El Xeris Computer ejecuta un nodo completo y sirve a Ari en el mismo equipo de 65 W, y ella no tiene ninguna capacidad de actuar en la cadena.

Los agentes acotados forman parte del diseño de la cadena desde el principio. El protocolo ARI del runtime registra un agente bajo un propietario con un límite de gasto por transacción, un tope diario, listas blancas de los contratos e instrucciones que puede tocar y un interruptor de emergencia que el propietario puede accionar en cualquier momento. Un agente solo puede delegar hacia abajo dentro de límites más estrictos que los suyos.

Ya corre donde corre la cadena, y cualquier autoridad que se le dé pasaría por esas primitivas, con topes, listas blancas y un interruptor de emergencia. Si a Ari se le confía algún día un papel en la cadena, será uno acotado, y hasta entonces solo conversa.

Lee el protocolo ARI en el whitepaper

Lo que el runtime impone a cualquier agente

Límite de gasto
por transacción
Tope diario
medido en ventanas de 21.600 slots
Listas blancas
de contratos y tipos de instrucción
Interruptor de emergencia
el propietario lo revoca todo de una vez
Subdelegación
profundidad acotada, límites más estrictos en cada nivel

Habla con ella en tu propio hardware.

Ari viene preinstalada en el Xeris Computer y se sirve en local, junto a un nodo completo de la cadena.