Claude Sonnet 5.5 适合有明确完成条件的工作:修复 Bug、把来源整理成简报,或按模板生成文档。Anthropic 9 月 28 日发布页称,它比 Sonnet 5 输出更快、单任务成本更低;API 牌价仍是每百万输入 2 美元、输出 10 美元。10 月 7 日,Anthropic 把 Sonnet 5.5 的缓存读取价格降至每百万 token 0.10 美元。这些是 API 价格和厂商测试结果,不等于 Tabbit 套餐价格。
在 Tabbit 中开始
打开 Tabbit,在当前账号的模型选择器中查找 Claude Sonnet 5.5。模型页介绍模型,但不代表每个账号都有使用权限。
打开要处理的网页或文件。只给一个明确任务,并写清输出格式和引用规则。
对照来源复核结果。代码任务要运行项目测试、检查改动;文档任务要核对数字、引文和遗漏章节。
只有在质量、速度或成本需要比较时,才用同一个任务测试其他模型。
可复制的来源整理提示词
打开资料后,把方括号替换成自己的需求:
任务:[一项具体交付物]。
只使用我提供的网页或文件作为证据。找不到依据的内容标为“未核实”,不要猜测。
输出:[格式和长度]。
每个重要事实都标注来源标题及对应章节或链接。
结束前按以下验收条件检查:[三项检查]。
只有缺少的信息确实阻止完成任务时才提问;否则写明合理假设并继续。这是 Tabbit 编辑用的任务模板,不是 Anthropic 原始提示词。它的作用是让结果便于复核。涉及私有资料时,先决定哪些内容适合输入 AI 工具。
什么时候选择 Sonnet 5.5
| 任务 | 首轮做法 | 复核条件 |
|---|---|---|
| 可复现的 Bug | 提供失败现象、相关文件和测试命令 | 运行测试,检查无关改动 |
| 基于网页的简报 | 写清读者、篇幅与引用格式 | 打开每条引用来源 |
| 幻灯片或表格初稿 | 提供模板与必填字段 | 核对公式、数字和版式 |
| 开放式架构决策 | 与 Opus 5.5 或人工审查比较 | 记录取舍和未解决风险 |
厂商公布的 Terminal-Bench 4.0 成绩为 70.6%,CursorBench 4.0 为 55.5%,但这些数字取决于测评设置,不能代替你在 Tabbit 中的实际任务结果。Anthropic 也说明,Opus 5.5 在需要持续判断的开放式复杂工作上仍更强。发布页注明:两项外部知识工作基准使用的预发布部署存在结构化输出 Bug,之后已修复。具体条件见逐来源测评。
进一步比较可查看 Sonnet 5.5 提示词合集、Opus 5.5 模型页和 Haiku 5.5 模型页。上一代 Sonnet 指南说明旧版定位;Opus 5.5 测评讨论复杂任务;Haiku 5.5 的 Tabbit 用法则面向高频小任务。
按任务选择思考档位
Anthropic 表示 Claude 应用和 Claude Code 默认使用 Medium effort,Claude Platform 默认使用 High。日常任务可先比较低档位的结果与耗时。如果 Tabbit 的模型界面提供 effort 设置,用同一任务测试后再决定;不要假定 Anthropic API 的每项参数都在其他客户端开放。
来源
Anthropic:Claude Sonnet 5.5:发布时间、定位、基准、effort 默认值与 API 定价;2026-10-09 核对。
Anthropic:Claude Haiku 5.5:10 月 7 日的 Sonnet 5.5 缓存读取降价;2026-10-09 核对。
常见问题
能在 Tabbit 中使用 Claude Sonnet 5.5 吗?
请在你自己的 Tabbit 账号中查看模型选择器。可用性可能随账号和发布进度变化;如果能选到 Sonnet 5.5,先用一个小任务测试,再用于更长的工作流。
Claude Sonnet 5.5 适合什么任务?
Anthropic 将它定位于边界清晰的日常任务、修复 Bug,以及制作文档、幻灯片和表格。需要持续判断的开放式复杂任务,仍值得与 Opus 5.5 比较。
Sonnet 5.5 比 Sonnet 5 便宜吗?
两者的 API 输入与输出 token 牌价相同。Anthropic 称 Sonnet 5.5 每件任务使用更少 token,且 10 月 7 日缓存读取降至每百万 token 0.10 美元。应以自己的完成任务成本判断。
应该选择哪个 effort 档位?
先用客户端提供的默认档位测试代表性任务。Anthropic 的 Claude 应用和 Claude Code 默认 Medium,Platform 默认 High;Tabbit 的可用设置以实际界面为准。
基准分数能保证我的任务结果吗?
不能。公开成绩依赖具体任务、工具和 effort 设置。应先跑一个小任务,并对照来源或项目测试核验结果。