Z.AI, la empresa china antes conocida como Zhipu AI, confirmó el 26 de agosto que Ox Alpha, el modelo que circuló seis días sin firma de fabricante, es una nueva iteración de su familia GLM. La compañía dijo que esa misma noche liberaría sus pesos, el conjunto de parámetros que permite a cualquier desarrollador correr el modelo en infraestructura propia. La confirmación llegó después de que Ox Alpha escalara al primer puesto del ranking de uso de OpenRouter, con un volumen que más que duplicó al de DeepSeek, su competidor chino más citado.
Ox Alpha había aparecido el 20 de agosto en OpenRouter, gratuito y sin ningún nombre de laboratorio adjunto. Ofrece una ventana de contexto de un millón de tokens (la cantidad de texto que el modelo puede procesar de una sola vez) y procesa imagen y video además de texto, algo que la versión pública de GLM-5.3, el modelo que Zhipu había lanzado oficialmente el 14 de agosto, no ofrece: esa versión es solo de texto. Esa diferencia técnica alimentó seis días de especulación sobre si Ox Alpha era el mismo GLM-5.3 con otro nombre o una variante distinta, más chica y con capacidades agregadas, que la comunidad empezó a llamar informalmente "Flash". Z.AI confirmó el parentesco con la familia GLM; no confirmó, al menos hasta el cierre de esta nota, ese nombre específico.
La filtración que llegó primero
Antes de la confirmación oficial, la evidencia más fuerte la produjo un desarrollador independiente. El 22 de agosto, la cuenta identificada como Chetaslua envió un pedido deliberadamente malformado a Ox Alpha a través de OpenCode. El servidor respondió con un stack trace de Java (el registro de error interno de un programa) que nombraba su propia clase: com.wd.paas.api.domain.v4.chat.ChatCompletionRequest, una ruta que coincide con la API documentada de Zhipu, /api/paas/v4/chat/completions.
Como control, Chetaslua probó tres modelos ya identificados de Zhipu en OpenRouter (GLM-5.3, GLM-5.2 y GLM-5V-Turbo) y los tres devolvieron el mismo mensaje de error que Ox Alpha: {"code":"1214","message":"Incorrect role information"}.
"That's the server confessing. Proven at the serving layer, confidence 0.98."
La cita, en el inglés original de la publicación, resume el método: identificó el origen del modelo a partir de un error que el propio servidor dejó escapar, con una ruta de API real como evidencia.
Lo que ya estaba confirmado, y lo que sigue sin estarlo
Sobre GLM-5.3, la ficha técnica de Zhipu es precisa. El modelo se construyó enteramente sobre post-entrenamiento aplicado a la misma base de GLM-5.2, sin nuevo preentrenamiento, y no permite desactivar su modo de razonamiento extendido.
| Benchmark | Mejora reportada por Zhipu |
|---|---|
| Terminal-Bench 3.0 | de 4,6% a 28,3% |
| DeepSWE v1.1 | de 46,2% a 66,9% |
Zhipu había planeado liberar los pesos abiertos de GLM-5.3 recién dos semanas después del lanzamiento del 14 de agosto, una vez completada la evaluación de seguridad. La confirmación del 26 de agosto adelanta esa liberación y la ata, por primera vez, al nombre público de Ox Alpha.
El otro número detrás del anuncio
OpenRouter registró 11,6 billones de tokens procesados por Ox Alpha en sus primeros tres días en la plataforma, cerca de 2,6 veces el récord previo de lanzamiento de un modelo. La confirmación de Z.AI llegó con ese volumen ya instalado en el primer puesto del ranking y con seis días de especulación pública acumulados sobre el origen del modelo. Falta por conocerse el nombre exacto que Zhipu le dará cuando publique los pesos, y si esa publicación explica también por qué la compañía eligió lanzarlo sin firma en primer lugar.

