Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
测评
社区GLM-5.3-Flash

X @winkey_h:Ox Alpha 的 DeepSWE 子集体测与社区反馈

原始来源

X(Twitter)

作者Wenqi/Kevin(@winkeyh)

原文日期2026-08-21

Tabbit 整理2026-08-27

查看原文

核心内容摘要

Wenqi/Kevin 分享了自己的早期体感与一个 DeepSWE 子集结果:平均每个任务约 47K 输出 token 时,Ox Alpha 得到约 63%。作者认为它在开源模型中处于 Pareto 前沿,与闭源模型相比仅略逊于 Grok 4.6;这属于个人测试与主观判断,不是标准化排行榜。

该帖引用了 OpenCode 关于 Ox Alpha 的公开信息(1M 上下文、多模态、零数据保留),但没有给出完整 prompt 集、任务数量、运行配置或代码。它也没有证明 Ox Alpha 的 GLM-5.3 Flash 身份。

能写入落地页的版本

“早期社区测试显示 Ox Alpha 在长程编码任务上有竞争力;但 63% 来自一个 DeepSWE 子集,不能替代完整 benchmark,也不能单独证明模型身份。”

测评价值

该结果的价值是提供可追溯的个人实测数字;局限是子集、单次测试条件不透明,不能与 Z.ai 官方 GLM-5.3 v1.1 分数直接比较。

Tabbit 小编提醒

本文是第三方资料导航。测试环境、模型版本和主观体验可能不同,请以原文为准。

GLM-5.3-Flash

在 Tabbit 中使用并对比模型

GLM-5.3-Flash

相关测评

官方OpenRouter2026-08-20

OpenRouter:Ox Alpha 的公开规格——神秘模型首次现身

官方X(Twitter)2026-08-21

X @OpenRouter:Ox Alpha 首次公开——1M 上下文与多模态输入

官方Z.ai 官方技术博客2026-08-14

Z.ai 官方 GLM-5.3:承袭 GLM-5.2 基座的后训练能力基线

社区X(Twitter)2026-08-25

X @di_zhang_fdu:Ox Alpha 被指认为 GLM-5.3 Flash,但仍未官宣