Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
测评
官方GLM-5.3-Flash

Z.ai 官方 GLM-5.3:承袭 GLM-5.2 基座的后训练能力基线

原始来源

Z.ai 官方技术博客

作者Z.ai

原文日期2026-08-14

Tabbit 整理2026-08-27

查看原文

核心内容摘要

Z.ai 对标准 GLM-5.3 的公开定位是:与 GLM-5.2 使用相同基座,能力提升来自扩展后训练,而不是更换预训练基座。重点方向包括长程软件工程、终端任务、工具调用和真实 Agent 工作单元。该基线可以解释为什么社区把一个 GLM-5.x 多模态变体称作“集成 GLM-5.2 级别智商”,但不等于 Flash 已被官方命名或与标准 5.3 完全同构。

官方基准(标准 GLM-5.3,非 Flash 实测)

Z.ai 技术资料给出的代表性厂商自报数据包括:Terminal-Bench 3.0 28.3(GLM-5.2 为 4.6)、DeepSWE v1.1 66.9(5.2 为 46.2)、CyberGym 84.5(5.2 为 77.2)、AutomationBench 48.2(5.2 为 26.2)。这些数字是标准 GLM-5.3 的公开基线,不能移植为 GLM-5.3 Flash/Ox Alpha 的成绩。

编辑使用建议

可说“Flash 延续 GLM-5.3/5.2 一脉的推理与 Agent 方向”,不可说“Flash 已复现上述全部分数”。任何 Flash 专属 benchmark 都需要独立、可复现的模型 ID 与测试条件。

Tabbit 小编提醒

本文是第三方资料导航。测试环境、模型版本和主观体验可能不同,请以原文为准。

GLM-5.3-Flash

在 Tabbit 中使用并对比模型

GLM-5.3-Flash

相关测评

官方OpenRouter2026-08-20

OpenRouter:Ox Alpha 的公开规格——神秘模型首次现身

官方X(Twitter)2026-08-21

X @OpenRouter:Ox Alpha 首次公开——1M 上下文与多模态输入

社区X(Twitter)2026-08-25

X @di_zhang_fdu:Ox Alpha 被指认为 GLM-5.3 Flash,但仍未官宣

社区X(Twitter)2026-08-21

X @winkey_h:Ox Alpha 的 DeepSWE 子集体测与社区反馈