TabbitBlog

Ox Alpha revelado como GLM-5.3-Flash

Ox Alpha es GLM-5.3-Flash. Repasamos la prueba anónima, las huellas técnicas, las evaluaciones públicas, la multimodalidad y su uso en Tabbit.

En este artículo
  1. Puntos clave
  2. Cronología de Ox Alpha
  3. Las huellas que apuntaban a GLM
  4. Inteligencia de GLM-5.2 con multimodalidad nativa
  5. Qué dicen las pruebas comunitarias
  6. Usar GLM-5.3-Flash en Tabbit
  7. Qué tarea elegir

Ox Alpha es GLM-5.3-Flash. El nombre se hizo público el 27 de agosto, después de una semana en la que el modelo ya había trabajado con repositorios, imágenes, vídeo y sesiones largas de agentes bajo una ruta anónima de OpenRouter.

En los comentarios de un vídeo de RandomAI, un desarrollador contó que completó una actualización de versión de principio a fin en una sola sesión. Es una experiencia personal, no un benchmark. Aun así, explica el interés: la gente ya estaba usando el modelo para trabajar. Ahora GLM-5.3-Flash también se puede elegir en Tabbit Browser.

Puntos clave

  • Ox Alpha apareció en OpenRouter el 20 de agosto de 2026 con un millón de tokens de contexto y proveedor anónimo.

  • Aceptaba texto, imagen y vídeo, y estaba pensado para programación y trabajo agentic prolongado.

  • Las huellas del tokenizer, el presupuesto de tokens de vídeo y los errores de Z.ai redujeron la identidad a la familia GLM antes del anuncio.

  • Las pruebas tempranas son indicios concretos, no una clasificación completa.

  • En Tabbit, Flash encaja mejor cuando la tarea mezcla razonamiento, páginas, capturas, documentos y acciones del navegador.

Cronología de Ox Alpha

FechaInformación públicaConclusión posible en ese momento
20 ago.OpenRouter publicó Ox Alpha como vista previa anónimaEl modelo existía, tenía 1M de contexto y su creador era desconocido
21 ago.OpenRouter en X confirmó texto, imagen y vídeoLa API era multimodal, pero no identificaba al laboratorio
21 a 25 ago.Aparecieron huellas y pruebas comunitariasGLM era la familia más probable, no todavía el nombre del producto
25 ago.Di Zhang nombró GLM-5.3-FlashEl nombre exacto entró en la conversación pública
27 ago.Ox Alpha fue revelado como GLM-5.3-FlashEl código y la identidad quedaron unidos

El 23 de agosto, TechCrunch todavía recogía hipótesis sobre GLM y Microsoft MAI. La incertidumbre anterior al anuncio era real.

Las huellas que apuntaban a GLM

El análisis de Jonathan Turner reunió mediciones difíciles de imitar con un prompt.

SeñalResultado informadoQué apoyabaQué no demostraba por sí sola
TokenizerOx y GLM-5.3 coincidieron en 50 de 50 cadenasVocabulario GLM-5.xPesos exactos
Tokens de vídeoCuatro vídeos coincidieron con GLM-5V-TurboCodificador visual de tipo GLM-VQue fuera el 5V-Turbo público
Errores del servicioRutas Java y códigos coincidieron con Z.ai PaaS v4Backend de Z.aiPropiedad de todo el postentrenamiento
Ficha del productoOx tenía 1M y visión; 5.3 público era solo textoUn GLM-5.x multimodal no publicadoEl nombre final

Google pasó de "quién creó Ox Alpha" a preguntar si era GLM-5.3-Flash. La búsqueda mostró el debate, pero las mediciones hicieron el trabajo. Turner llegó hasta familia GLM y servicio Z.ai. Di Zhang añadió el nombre exacto. El anuncio del día 27 cerró el caso.

Inteligencia de GLM-5.2 con multimodalidad nativa

El artículo técnico de Z.ai afirma que GLM-5.3 estándar usa la misma base que GLM-5.2. La mejora vino de más entornos ejecutables, tareas largas y cómputo de postentrenamiento. Puedes revisar GLM-5.2 en Tabbit y la ruta de GLM-5.1 para entender la línea anterior.

GLM-5.3-Flash añade entrada multimodal nativa. Durante la prueba, una sola ruta aceptaba texto, imágenes y vídeo. Eso sirve para leer una captura, compararla con una especificación y continuar con documentos o código.

Los resultados publicados para GLM-5.3 estándar no son resultados de Flash. Las tareas pueden parecerse, pero el checkpoint y el harness deben verificarse de forma independiente.

Qué dicen las pruebas comunitarias

Wenqi/Kevin informó cerca de 63 por ciento en un subconjunto de DeepSWE con unos 47K tokens de salida promedio. No publicó la lista completa de tareas, repeticiones ni un envío oficial al ranking.

Cline comparó Ox Alpha y Fable en un bug real de su repositorio. Ambos lo corrigieron. Cline dijo que Ox repitió menos razonamiento y usó cerca de tres veces menos tokens de salida. Un bug no decide un ranking, pero sí muestra un comportamiento útil.

Nuestra guía de razonamiento agentic explica cómo evaluar el ciclo completo. Para roleplay y presets, consulta la guía separada de GLM-5.3 en SillyTavern.

Usar GLM-5.3-Flash en Tabbit

  1. Abre Tabbit Browser. Usa Chat para analizar y Agent Mode para tareas web de varios pasos.

  2. Elige GLM-5.3-Flash en el selector.

  3. Escribe @ para adjuntar una página, un grupo de pestañas, una captura o un archivo.

  4. Define el resultado, las comprobaciones y los límites.

Interfaz multimodelo de Tabbit con GPT, Claude, Kimi, Qwen y GLM en paralelo
Tabbit ejecuta varias familias en paralelo. Esta interfaz anterior muestra GLM-5.2; GLM-5.3-Flash usa el mismo flujo de selección.

La guía de navegador para investigación ayuda con páginas, PDF y gráficos. Tabbit no sustituye un harness de programación ni promete límites ilimitados; consulta los precios de Tabbit.

Qué tarea elegir

TareaAjusteUsoLímite
Comparar captura de UI y especificaciónAltoAdjuntar ambas y pedir diferencias verificablesConservar fuentes y pruebas visuales
Investigación con páginas, gráficos y PDFAltoAgrupar fuentes y exigir citasEvitar resúmenes sin fuentes
Flujo de navegador con estado visualAltoAgent en un grupo separadoRevisar cambios
Parche grande de repositorioMixtoTabbit para documentación, harness para códigoNo sustituye git ni CI
Pregunta de texto simpleAceptableChat sin adjuntosUn modelo menor puede ser más rápido

GLM-5.3-Flash interesa cuando el razonamiento largo de GLM necesita contexto visual. Los datos tempranos justifican probarlo en trabajo agentic real, no copiar todos los resultados de GLM-5.3 ni declararlo ganador universal. Para contrastarlo con otro modelo de contexto largo, consulta la guía de GPT-5.6 Sol 1M.

Preguntas frecuentes

¿Ox Alpha es realmente GLM-5.3-Flash?

Sí. El 27 de agosto de 2026, Ox Alpha fue revelado como GLM-5.3-Flash. Antes del anuncio, OpenRouter solo lo identificaba como la vista previa anónima stealth/ox-alpha, aunque las huellas del tokenizer, el vídeo y los errores del servidor ya apuntaban a GLM y a la infraestructura de Z.ai.

¿GLM-5.3-Flash es igual que GLM-5.3?

No. El GLM-5.3 estándar se publicó como modelo de texto para programación y trabajo de agentes de larga duración. GLM-5.3-Flash continúa esa línea de inteligencia y añade entrada nativa de texto, imagen y vídeo. Sus resultados deben medirse por separado.

¿Qué hereda GLM-5.3-Flash de GLM-5.2?

Z.ai afirma que GLM-5.3 estándar usa el mismo modelo base que GLM-5.2 y mejora mediante más postentrenamiento. Esa línea se centra en programación, herramientas y tareas largas. Flash la combina con entrada multimodal nativa.

¿Qué entradas aceptaba Ox Alpha durante la prueba?

OpenRouter indicó un contexto de un millón de tokens y entrada de texto, imagen y vídeo, con salida de texto. El modelo se presentó para programación, agentes persistentes y cargas de producción. La gratuidad de la prueba no era una promesa permanente.

¿Qué tal fueron las primeras pruebas de Ox Alpha?

Fueron señales prometedoras, pero incompletas. Wenqi/Kevin informó cerca de 63 por ciento en un subconjunto de DeepSWE, mientras Cline describió un bug real resuelto con alrededor de tres veces menos tokens de salida que Fable.

¿Cómo uso GLM-5.3-Flash en Tabbit?

Abre Tabbit Browser, inicia un Chat o una tarea Agent y elige GLM-5.3-Flash. Escribe @ para adjuntar la página actual, un grupo de pestañas, una captura o un archivo local. Consulta el selector y la página de precios para conocer la disponibilidad y los límites actuales.

Da el siguiente paso

Deja que Tabbit trabaje junto a ti.

Investiga entre pestañas, automatiza el trabajo repetitivo del navegador y mantén todo el contexto al alcance.