Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
提示词与工作流

Ox Alpha · workflow

自定义语言长任务工作流

先给 Ox Alpha 一份不可能来自训练集的自定义语言文档,再分阶段实现游戏和语言特性,是检验 Agent 能否读文档、持续编码和回归验证的实用工作流

编辑示例;未实测OpenCode coding harness

前置条件与输入

  • 任务目标
  • 运行环境
  • 验收标准

完整可复制模板

编辑改写:自定义语言长任务工作流

Tabbit 编辑改写;非来源原文
先阅读 {{LANG_SPEC}} 中相关规则,再为 {{GAME_BRIEF}} 制定分阶段计划。先写规则摘要、未知点和最小可验证切片;每个切片运行 {{TEST_COMMAND}},记录失败、修复和未验证项;将语言特性、游戏逻辑和测试分离,最后给出文件树、命令和完成/待完成清单。

语言资料:{{LANG_SPEC}}
游戏目标:{{GAME_BRIEF}}
验证命令:{{TEST_COMMAND}}

运行前仍需替换: {{LANG_SPEC}}, {{GAME_BRIEF}}, {{TEST_COMMAND}}

操作步骤

  1. 固定输入、变量和运行环境,确认有权发送资料。

  2. 替换所有必填变量;模板不会自动读取客户端状态,也不会自动执行代码或工具。

  3. 保存原始输出、错误和人工修正,未实际运行的结果标为待验证。

  4. 逐项执行验收;失败时先缩小变量范围,不把示例当成实测。

边界

这是基于公开来源的 Tabbit 编辑改写,不复制未公开系统提示词或受限全文。来源只支持该任务方向,不支持对模型的普遍性能承诺。

查看来源研究笔记

一句话结论

先给 Ox Alpha 一份不可能来自训练集的自定义语言文档,再分阶段实现游戏和语言特性,是检验 Agent 能否读文档、持续编码和回归验证的实用工作流。

适用场景

  • 适合的任务:自定义 DSL、内部 SDK、少量文档驱动的应用和游戏原型。

  • 不适合的任务:没有测试入口、不能回滚的生产仓库,或把“能生成代码”当成“实现正确”。

  • 适用的模型版本:Ox Alpha;原帖没有版本快照。

  • 适用的客户端、Agent 或 API:OpenCode CLI;原帖明确是在 OpenCode 中使用。

  • 推荐的推理档位和参数:未公开;长任务应固定上下文、工具权限和超时。

可直接使用的内容

原帖没有公开完整逐字 prompt,下面是按原帖公开步骤整理的可复用工作流,不应引用为原始 prompt:

你将使用仓库中的自定义语言文档实现一个简单的平台游戏。

阶段 1:先阅读并总结文档,列出语法、运行方式和当前不确定点;不要猜测未写明的语义。
阶段 2:实现一个可运行的平台游戏,包含 10 个关卡。先完成最小可运行版本,再逐关验证。
阶段 3:运行项目已有检查或最小回归测试,报告每个关卡是否能启动、输入是否生效、失败原因是什么。
阶段 4:新增 modulo 运算符。同步更新解析、执行、错误处理和文档,并为正数、负数、零和非法输入补测试。
阶段 5:再次运行全部回归测试,只修改与任务有关的文件,最后给出文件清单和未解决问题。

复用要点

  • 把自定义语言文档放入仓库并明确“以文档为准”。

  • 将“实现游戏”和“新增语言特性”拆成两轮,避免一次任务掩盖回归问题。

  • 每轮都要求运行结果和失败原因,而不是只输出代码。

  • 使用可回滚分支;自定义语言的正确性必须由运行时或测试验证。

原始案例结果

作者称模型在给出文档后完成了 10 关平台游戏,还能新增 modulo 运算符;作者同时说明关卡设计一般,但功能可用。该结果是个人报告,不含代码仓库、commit 或测试日志。

来源与日期

Reddit · 原文日期: 2026-08-22 · 编辑日期: 2026-09-20

阅读原始来源
变量检查

仍需替换: 3

{{LANG_SPEC}}{{GAME_BRIEF}}{{TEST_COMMAND}}

相关提示词

Agent 卡住排障参考驱动的前端 UI 工作流OpenCode 上的 Ox Alpha:长上下文与免费预览配置OpenCode 1.18.21:Ox Alpha 中途停止的自动重试

相关测评

独立 LiveCodeBench v6:Ox Alpha 原始 Pass@1同图像、同 prompt、三 Harness:Ox Alpha 的框架影响OpenCode 官方观测:四天 26T Ox Alpha tokensOpenCode 官方 Go 入口:免费期与负载反馈

模型深度阅读

总览 · 简体中文

Ox Alpha 是什么:从匿名预览到 GLM-5.3-Flash

Ox Alpha 曾是 Z.ai GLM-5.3-Flash 的匿名预览名。本文核对公开规格、获取边界、预览时间线与安全测试方式。

Ox Alpha

在 Tabbit 中使用 Ox Alpha

请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。