Esta es Ari.
Un modelo de lenguaje de siete mil millones de parámetros que escribimos desde cero en NumPy, hecho para correr en la CPU de la misma máquina que ejecuta la cadena. Mantiene una conversación. Por diseño, eso es todo lo que hace.
- Parámetros
- 7B
- Escrita desde cero en
- NumPy
- Runtime en la CPU
- INT4
- Telemetría ni llamadas a la nube
- Ninguna
Cómo la construimos
Siete mil millones de parámetros, escritos desde primeros principios.
Escribimos el modelo en NumPy y el motor que lo ejecuta, y entrenamos los pesos desde cero. Debajo no hay ninguna API de terceros ni ningún modelo base.
Sin framework debajo
La arquitectura está escrita en NumPy y no depende de PyTorch ni de una API alojada. No le afecta ninguna política externa ni ninguna deprecación.
Siete mil millones de parámetros
Es un modelo de 7B parámetros que entrenamos nosotros mismos, desde cero. Los pesos, la suite de evaluación y el pipeline de entrenamiento también son nuestros.
Un motor de inferencia para la CPU
El Xeris Inference Engine ejecuta todo el modelo en la CPU con un runtime de matrices propio, optimizado en INT4. La inferencia está limitada por el ancho de banda de memoria, así que el motor está afinado para DDR5 de doble canal.
Instalada en el equipo
Viene instalada de fábrica en el Xeris Computer junto a un nodo completo de Xeris y sirve inferencia por HTTP/RPC local. Los prompts se quedan en la máquina.
Qué hace
Su única función es la conversación.
Ari es un modelo solo de conversación. Le haces una pregunta y la responde. Por diseño no tiene herramientas, llaves ni autoridad, en la cadena ni en ningún otro sitio.
Lo que hace
- Responder preguntas y mantener una conversación.
- Correr en tu propio hardware, sin conexión si lo prefieres.
- Mantener cada prompt en la máquina donde se escribió.
Lo que no hace
- Guardar llaves ni firmar nada.
- Mover fondos ni tocar la cadena.
- Navegar por la web, llamar herramientas ni ejecutar código.
Ari y la cadena
La cadena ya tiene las reglas para un agente con autoridad.
La L1 de Xeris es todo lo que construimos. Ari es nuestro modelo, y por ahora corre junto a la cadena sin ningún papel en ella. Las reglas de la cadena para agentes se escribieron antes de que ella estuviera lista.
Hoy las dos solo comparten una máquina. El Xeris Computer ejecuta un nodo completo y sirve a Ari en el mismo equipo de 65 W, y ella no tiene ninguna capacidad de actuar en la cadena.
Los agentes acotados forman parte del diseño de la cadena desde el principio. El protocolo ARI del runtime registra un agente bajo un propietario con un límite de gasto por transacción, un tope diario, listas blancas de los contratos e instrucciones que puede tocar y un interruptor de emergencia que el propietario puede accionar en cualquier momento. Un agente solo puede delegar hacia abajo dentro de límites más estrictos que los suyos.
Ya corre donde corre la cadena, y cualquier autoridad que se le dé pasaría por esas primitivas, con topes, listas blancas y un interruptor de emergencia. Si a Ari se le confía algún día un papel en la cadena, será uno acotado, y hasta entonces solo conversa.
Lee el protocolo ARI en el whitepaperLo que el runtime impone a cualquier agente
- Límite de gasto
- por transacción
- Tope diario
- medido en ventanas de 21.600 slots
- Listas blancas
- de contratos y tipos de instrucción
- Interruptor de emergencia
- el propietario lo revoca todo de una vez
- Subdelegación
- profundidad acotada, límites más estrictos en cada nivel
Habla con ella en tu propio hardware.
Ari viene preinstalada en el Xeris Computer y se sirve en local, junto a un nodo completo de la cadena.