✨︎ Resumen (TL;DR):
- Ox Alpha apareció el 20 de agosto de 2026 en OpenRouter con 1,048,576 tokens de contexto, salida de hasta 131,072 tokens y entrada de texto, imagen y video.
- OpenCode anunció una semana de acceso, capacidad para 100 billones de tokens al día y “retención cero de datos”, pero OpenRouter dice que el proveedor conserva prompts y respuestas.
- Ningún laboratorio lo ha reclamado; las pistas del tokenizador apuntan a GLM de Z.ai o MAI de Microsoft, mientras el dato de más de 80% en DeepSWE salió de solo 10 tareas.
Nadie ha identificado al operador de Ox Alpha, un modelo de IA que apareció gratis en OpenRouter el 20 de agosto de 2026. Su ficha ofrece 1,048,576 tokens de contexto, entrada de texto, imagen y video, y salida de hasta 131,072 tokens. OpenCode promete retención cero, pero OpenRouter dice que el proveedor anónimo conserva prompts y respuestas, aunque no los use para entrenar.

La oferta gratis depende de un proveedor anónimo
Ox Alpha llegó a OpenRouter con el identificador stealth/ox-alpha. La ficha atribuye el desarrollo y la operación a un tercero que decidió permanecer anónimo durante el preview. OpenRouter aclara que solo enruta las peticiones y no es el desarrollador, dueño ni proveedor.
El acceso cuesta cero. OpenCode, el agente de programación de terminal que también lo distribuye, anunció límites casi ilimitados durante una semana.
También anunció capacidad para 100 billones de tokens al día, equivalentes a 100 millones de millones. Su aviso usa la frase exacta “retención cero de datos”.
La ventana gratuita comenzó el 20 de agosto y dura una semana. La página de OpenRouter agrega otra condición: el proveedor que ejecuta el modelo conserva los prompts y las respuestas, aunque se compromete a no usarlos para entrenar. Los Stealth Model Terms rigen el resto y están separados de las condiciones del catálogo normal.
OpenCode describe lo que hace el cliente por el que pasa el tráfico; OpenRouter describe lo que hace el proveedor al final de la cadena. Una promesa no cancela la otra, y nadie ha dicho quién firma la segunda.
La ficha también indica que un único proveedor sirve Ox Alpha. Si falla, OpenRouter no tiene otro proveedor al cual enviar la petición. Tres días después del estreno, nadie había dicho quién era ese operador.
El tokenizador divide las pistas entre Z.ai y Microsoft
Tokenizador es una pieza del procesamiento de lenguaje que convierte el texto en números antes de que el modelo lo procese.
Techstrong.ai reportó que las pruebas de desarrolladores con varios prompts de referencia dieron conteos casi idénticos a los de GLM-5.3, de Z.ai, antes Zhipu AI. El análisis atribuye la diferencia a un envoltorio estándar. Otros indicios, como ciertos errores con tokens corruptos, coinciden con comportamientos previos de las familias Qwen y GLM.
NPowerUser reportó coincidencias exactas en 30 de 30 pruebas de tokenizador, un código de error de servidor asociado con la infraestructura de Z.ai y paridad de fotogramas por token con el codificador de video GLM-5V-Turbo.
La referencia citada corresponde al 19 de agosto: GLM-5.3 alcanzó el nivel de Kimi K3 en el índice de Artificial Analysis.
Robert Lukoszko, director ejecutivo de Stormy, sostuvo que Ox Alpha usa cl100k_base, el tokenizador desarrollado por OpenAI. En su interpretación, esa huella descarta a OpenAI, Google, Anthropic, xAI y a todos los laboratorios chinos de frontera.
Por esa razón, Lukoszko señaló a MAI de Microsoft como el candidato más probable. Wccftech recogió esa lectura al actualizar una nota que antes apuntaba a un GLM no publicado.
Techstrong.ai también mencionó una tercera posibilidad: el equipo MiMo de Xiaomi, que ya había probado modelos en OpenRouter bajo seudónimos como Hunter Alpha antes de anunciarlos.
La primera hipótesis que circuló fue Gemini, impulsada por publicaciones de investigadores de Google DeepMind. El análisis técnico llevó después la conversación hacia China. Ninguna hipótesis está confirmada y nadie ha dicho quién opera Ox Alpha.
100 billones de tokens y un benchmark sin auditoría
Wccftech recogió un cálculo de la cuenta Teortaxes: mover 100 billones de tokens diarios a las velocidades observadas exigiría cerca de 580,000 GPU. La conclusión es que esa cifra probablemente no se refiere a tokens de salida. Ninguna de las partes involucradas lo ha aclarado.
Los desarrolladores difundieron un puntaje de más de 80% en DeepSWE, un banco de pruebas para agentes de programación. Un desarrollador lo obtuvo al ejecutar solo 10 tareas, no en una tabla auditada. Las versiones que circulan tampoco coinciden en qué modelo rival consiguió 65%.
Techstrong.ai advierte que Ox Alpha todavía no tiene validación independiente en tablas públicas formales. La recomendación citada es tomar con calma los benchmarks nacidos en redes sociales, porque suelen decir poco sobre la estabilidad a largo plazo.
Los agentes de programación concentran el tráfico
Al 22 de agosto, el tablero de OpenRouter mostraba que las apps con más tráfico hacia Ox Alpha eran agentes de programación, no interfaces de chat:
- Hermes Agent, de Nous Research: 490,000 millones de tokens.
- Claude Code, de Anthropic: 314,000 millones de tokens.
- omp: 279,000 millones de tokens.
- DeepSeek Harness: 242,000 millones de tokens.
- pi: 129,000 millones de tokens.
El mismo tablero registraba 19 tokens por segundo y 99.51% de disponibilidad durante tres días. El tablero permite ver quién lo está usando, pero no identifica a su operador ni valida por sí solo el puntaje de DeepSWE.
OpenRouter cambia mientras el preview se acaba
Techstrong.ai reporta que la proporción de tokens procesados por modelos estadounidenses en OpenRouter cayó de 70% a alrededor de 30% en un año. En paralelo, los laboratorios chinos ganan terreno con lanzamientos de contexto amplio y precio bajo.
Stripe anunció el 19 de agosto la compra de OpenRouter, una operación que todavía está pendiente de cierre.
El preview gratuito dura una semana a partir del 20 de agosto, así que termina en cuestión de días. Ox Alpha llegará al final con el mismo hueco con el que empezó, sin nombre en la casilla del fabricante.
Durante la ventana gratuita pasaron cientos de miles de millones de tokens de código por un modelo cuyo operador nadie ha identificado. Ese registro ya existe y no se deshace cuando llegue el anuncio del laboratorio.
