Ox Alpha es GLM-5.3-Flash. El nombre se hizo público el 27 de agosto, después de una semana en la que el modelo ya había trabajado con repositorios, imágenes, vídeo y sesiones largas de agentes bajo una ruta anónima de OpenRouter.
En los comentarios de un vídeo de RandomAI, un desarrollador contó que completó una actualización de versión de principio a fin en una sola sesión. Es una experiencia personal, no un benchmark. Aun así, explica el interés: la gente ya estaba usando el modelo para trabajar. Ahora GLM-5.3-Flash también se puede elegir en Tabbit Browser.
Puntos clave
Ox Alpha apareció en OpenRouter el 20 de agosto de 2026 con un millón de tokens de contexto y proveedor anónimo.
Aceptaba texto, imagen y vídeo, y estaba pensado para programación y trabajo agentic prolongado.
Las huellas del tokenizer, el presupuesto de tokens de vídeo y los errores de Z.ai redujeron la identidad a la familia GLM antes del anuncio.
Las pruebas tempranas son indicios concretos, no una clasificación completa.
En Tabbit, Flash encaja mejor cuando la tarea mezcla razonamiento, páginas, capturas, documentos y acciones del navegador.
Cronología de Ox Alpha
| Fecha | Información pública | Conclusión posible en ese momento |
|---|---|---|
| 20 ago. | OpenRouter publicó Ox Alpha como vista previa anónima | El modelo existía, tenía 1M de contexto y su creador era desconocido |
| 21 ago. | OpenRouter en X confirmó texto, imagen y vídeo | La API era multimodal, pero no identificaba al laboratorio |
| 21 a 25 ago. | Aparecieron huellas y pruebas comunitarias | GLM era la familia más probable, no todavía el nombre del producto |
| 25 ago. | Di Zhang nombró GLM-5.3-Flash | El nombre exacto entró en la conversación pública |
| 27 ago. | Ox Alpha fue revelado como GLM-5.3-Flash | El código y la identidad quedaron unidos |
El 23 de agosto, TechCrunch todavía recogía hipótesis sobre GLM y Microsoft MAI. La incertidumbre anterior al anuncio era real.
Las huellas que apuntaban a GLM
El análisis de Jonathan Turner reunió mediciones difíciles de imitar con un prompt.
| Señal | Resultado informado | Qué apoyaba | Qué no demostraba por sí sola |
|---|---|---|---|
| Tokenizer | Ox y GLM-5.3 coincidieron en 50 de 50 cadenas | Vocabulario GLM-5.x | Pesos exactos |
| Tokens de vídeo | Cuatro vídeos coincidieron con GLM-5V-Turbo | Codificador visual de tipo GLM-V | Que fuera el 5V-Turbo público |
| Errores del servicio | Rutas Java y códigos coincidieron con Z.ai PaaS v4 | Backend de Z.ai | Propiedad de todo el postentrenamiento |
| Ficha del producto | Ox tenía 1M y visión; 5.3 público era solo texto | Un GLM-5.x multimodal no publicado | El nombre final |
Google pasó de "quién creó Ox Alpha" a preguntar si era GLM-5.3-Flash. La búsqueda mostró el debate, pero las mediciones hicieron el trabajo. Turner llegó hasta familia GLM y servicio Z.ai. Di Zhang añadió el nombre exacto. El anuncio del día 27 cerró el caso.
Inteligencia de GLM-5.2 con multimodalidad nativa
El artículo técnico de Z.ai afirma que GLM-5.3 estándar usa la misma base que GLM-5.2. La mejora vino de más entornos ejecutables, tareas largas y cómputo de postentrenamiento. Puedes revisar GLM-5.2 en Tabbit y la ruta de GLM-5.1 para entender la línea anterior.
GLM-5.3-Flash añade entrada multimodal nativa. Durante la prueba, una sola ruta aceptaba texto, imágenes y vídeo. Eso sirve para leer una captura, compararla con una especificación y continuar con documentos o código.
Los resultados publicados para GLM-5.3 estándar no son resultados de Flash. Las tareas pueden parecerse, pero el checkpoint y el harness deben verificarse de forma independiente.
Qué dicen las pruebas comunitarias
Wenqi/Kevin informó cerca de 63 por ciento en un subconjunto de DeepSWE con unos 47K tokens de salida promedio. No publicó la lista completa de tareas, repeticiones ni un envío oficial al ranking.
Cline comparó Ox Alpha y Fable en un bug real de su repositorio. Ambos lo corrigieron. Cline dijo que Ox repitió menos razonamiento y usó cerca de tres veces menos tokens de salida. Un bug no decide un ranking, pero sí muestra un comportamiento útil.
Nuestra guía de razonamiento agentic explica cómo evaluar el ciclo completo. Para roleplay y presets, consulta la guía separada de GLM-5.3 en SillyTavern.
Usar GLM-5.3-Flash en Tabbit
Abre Tabbit Browser. Usa Chat para analizar y Agent Mode para tareas web de varios pasos.
Elige GLM-5.3-Flash en el selector.
Escribe
@para adjuntar una página, un grupo de pestañas, una captura o un archivo.Define el resultado, las comprobaciones y los límites.

La guía de navegador para investigación ayuda con páginas, PDF y gráficos. Tabbit no sustituye un harness de programación ni promete límites ilimitados; consulta los precios de Tabbit.
Qué tarea elegir
| Tarea | Ajuste | Uso | Límite |
|---|---|---|---|
| Comparar captura de UI y especificación | Alto | Adjuntar ambas y pedir diferencias verificables | Conservar fuentes y pruebas visuales |
| Investigación con páginas, gráficos y PDF | Alto | Agrupar fuentes y exigir citas | Evitar resúmenes sin fuentes |
| Flujo de navegador con estado visual | Alto | Agent en un grupo separado | Revisar cambios |
| Parche grande de repositorio | Mixto | Tabbit para documentación, harness para código | No sustituye git ni CI |
| Pregunta de texto simple | Aceptable | Chat sin adjuntos | Un modelo menor puede ser más rápido |
GLM-5.3-Flash interesa cuando el razonamiento largo de GLM necesita contexto visual. Los datos tempranos justifican probarlo en trabajo agentic real, no copiar todos los resultados de GLM-5.3 ni declararlo ganador universal. Para contrastarlo con otro modelo de contexto largo, consulta la guía de GPT-5.6 Sol 1M.
Preguntas frecuentes
¿Ox Alpha es realmente GLM-5.3-Flash?
Sí. El 27 de agosto de 2026, Ox Alpha fue revelado como GLM-5.3-Flash. Antes del anuncio, OpenRouter solo lo identificaba como la vista previa anónima stealth/ox-alpha, aunque las huellas del tokenizer, el vídeo y los errores del servidor ya apuntaban a GLM y a la infraestructura de Z.ai.
¿GLM-5.3-Flash es igual que GLM-5.3?
No. El GLM-5.3 estándar se publicó como modelo de texto para programación y trabajo de agentes de larga duración. GLM-5.3-Flash continúa esa línea de inteligencia y añade entrada nativa de texto, imagen y vídeo. Sus resultados deben medirse por separado.
¿Qué hereda GLM-5.3-Flash de GLM-5.2?
Z.ai afirma que GLM-5.3 estándar usa el mismo modelo base que GLM-5.2 y mejora mediante más postentrenamiento. Esa línea se centra en programación, herramientas y tareas largas. Flash la combina con entrada multimodal nativa.
¿Qué entradas aceptaba Ox Alpha durante la prueba?
OpenRouter indicó un contexto de un millón de tokens y entrada de texto, imagen y vídeo, con salida de texto. El modelo se presentó para programación, agentes persistentes y cargas de producción. La gratuidad de la prueba no era una promesa permanente.
¿Qué tal fueron las primeras pruebas de Ox Alpha?
Fueron señales prometedoras, pero incompletas. Wenqi/Kevin informó cerca de 63 por ciento en un subconjunto de DeepSWE, mientras Cline describió un bug real resuelto con alrededor de tres veces menos tokens de salida que Fable.
¿Cómo uso GLM-5.3-Flash en Tabbit?
Abre Tabbit Browser, inicia un Chat o una tarea Agent y elige GLM-5.3-Flash. Escribe @ para adjuntar la página actual, un grupo de pestañas, una captura o un archivo local. Consulta el selector y la página de precios para conocer la disponibilidad y los límites actuales.