Claude Sonnet 4.6 是 Anthropic 于 2026 年 2 月发布的模型,面向编码、电脑操作、长上下文推理、智能体规划、知识工作和设计。它仍然有用,但最重要的标签不是“最新 Sonnet”,而是 Active (legacy):现有工作流可以继续使用,新系统则应先和 Sonnet 5 对比。
决定点是生命周期和价格的错位。Sonnet 4.6 模型页在 2026 年 9 月 20 日核对时列出 1M 上下文、128K 输出和输入/输出每百万 token 3/15 美元,同时建议迁移到价格为 2/10 美元的 Sonnet 5。Anthropic 自营平台的退休时间不早于 2027 年 2 月 17 日。“仍可用”不等于“新项目最佳默认”。
关键结论
Sonnet 4.6 面向编码、电脑操作、长上下文、智能体规划、文档和设计。
API ID 为
claude-sonnet-4-6;模型页列出 1M 上下文、128K 输出、adaptive thinking,以及文本/图像输入。API 价格是输入 $3/M、输出 $15/M,并有缓存读写费和 Batch API 五折。
Anthropic 报告电脑操作和 Claude Code 体验相对 4.5 改善;这是厂商测试,不是公开统一重跑。
4.6 为 Active (legacy),官方建议 Sonnet 5;Anthropic 自营平台的退休下限为 2027-02-17,Bedrock 和 Google Cloud 另算。
Sonnet 4.6 规格速览
Sonnet 4.6 模型资源、提示词集合和测评集合保存模型来源,不会授予 API 额度、Claude 订阅或浏览器可用性。
| 问题 | 当前答案 | 边界 |
|---|---|---|
| 定位 | 2026 年 2 月的代码、工具和知识工作升级 | 定位不是成功保证。 |
| 模型 ID | claude-sonnet-4-6 | Bedrock 使用不同 provider ID。 |
| 上下文 / 输出 | 1M / 128K token | API 上限,客户端可能更早压缩。 |
| 输入 / 输出 | 文本和图像 / 文本 | 页面未列音频和视频。 |
| Thinking | Adaptive;extended deprecated;默认 high | UI/provider 控制可能不同。 |
| API 价格 | 输入 $3、输出 $15 / 百万 token;缓存读 $0.30 | 缓存写、批处理和订阅另算。 |
| 状态 | Active (legacy),建议迁移 Sonnet 5 | legacy 不代表持续更新。 |
| 退休 | Anthropic 自营平台不早于 2027-02-17 | Bedrock/Google Cloud 各自安排。 |
改变了什么,基准不能证明什么
Anthropic 将 4.6 描述为编码、电脑操作、长上下文推理、智能体规划、知识工作和设计的全面升级,并称早期 Claude Code 测试中用户约 70% 偏好 4.6 而非 4.5,约 59% 偏好 4.6 而非 Opus 4.5。它还报告更强的 prompt injection 抵抗力。这些是 Anthropic 的测试和安全结论,不是独立统一复现。
Sonnet 5 总览负责当前 Sonnet 路线;Opus 4.7和 Opus 4.8负责高成本路线和生命周期。不要把它们的 benchmark、客户引语与 4.6 的 OSWorld 或社区实验合并成单一排名。
获取和计费:不要混用产品
Claude API: 组织和 provider 仍提供
claude-sonnet-4-6时使用,并记录模型 ID、effort、缓存、输入/输出 token、重试和验收结果。Claude 应用和 Cowork: 发布时 Anthropic 称 4.6 是 Free/Pro 默认模型;当前计划和选择器必须实时核对。
Claude Code/Desktop: CLI、Desktop 和应用选择器可能不同。社区曾报告 CLI 看不到 4.6,但显式
/model claude-sonnet-4-6仍可切换。云平台: Bedrock、Google Cloud 和 Microsoft Foundry 有自己的 ID 和生命周期。
成本: $3/$15 是 API 价格,不是订阅换算;缓存、批处理、工具和重试会改变实际成本。
按场景自检并做迁移试验
| 场景 | 先试什么 | 提交前检查 |
|---|---|---|
| 已有 4.6 API 集成 | 重跑固定回归样本 | ID、provider、缓存、测试和退休公告 |
| 广度型 PR 审查或浏览器冒烟 | 与 Sonnet 5 使用相同任务比较 | 发现数、通过率、恢复、延迟、每个验收结果的成本 |
| 深层架构追踪 | 把 Opus 作为专门角色 | 多跳发现、工具调用、审核修改和溢价 |
| 长 PDF 或合同 | 在可回滚样本上试 4.6/Sonnet 5 | 页覆盖、表格/脚注、引用和人工校验 |
| 新生产系统 | 先基准测试 Sonnet 5,4.6 保留作回退 | 生命周期、provider、质量和回滚路径 |
一份 Reddit agentic PR 实测使用 High effort、每模型 10 次、29 文件约 4K 行 PR 和 10 次浏览器 QA。Sonnet 平均找到 9 个问题,Opus 找到 6 个;两者浏览器流程均 7/7,Sonnet 约 $0.24/run,Opus 约 $1.32。它是单团队路由假设,不是普遍得分。
浏览器任务可参考 AI 浏览器指南和 Tabbit Browser 总览;Tabbit 价格页不是 Anthropic API 价格。
社区和媒体证据能说明什么
PDF 报告称 4.6 处理 90 页 PDF 优于 GPT-5.5;评论提醒干净 Markdown 仍可能漏行、合并单元格、改数字或丢脚注。复杂文档必须做页数、表格和随机样本校验。
Sonnet 5 出现后,一则 Reddit 对照称 4.6 在 Terraform 变量遵循上胜过 Sonnet 5。这是主观、非盲测观察,却说明 legacy 模型在窄工作流中仍可能有价值。
YouTube 只能提供检查清单。Developers Digest涉及电脑操作、benchmark caveats、adaptive thinking、GUI 安全和 1M beta 限制;Binary Verse AI涉及 price per success、1M beta trap 和部署安全。它们不是统一分数。
Tabbit 的作用与边界
如果工作从网页、标签、文件、截图或浏览器自动化开始,Tabbit Browser可以提供独立的浏览器运行时。它不会扩展上下文、改变 legacy 退休日期,也不能证明 4.6 出现在你的选择器中。本文没有已登录 Sonnet 4.6 实测,请用小型可回滚流程核对实时标签和限制。
CTA 下载的是 Tabbit Browser,不是 Claude 使用资格。浏览器费用、Anthropic 订阅限制与 API 价格分开记录。
未知风险
Legacy 漂移: Anthropic 说 legacy 模型不再获得更新,并建议使用 active 模型;退休前支持和行为仍可能变化。
Provider 分化: Anthropic 自营平台、Bedrock 和 Google Cloud 的 ID、可用性和日期可能不同。
长上下文忠实度: 1M 是上限,不代表每页、表格、引用和指令都能稳定保留。
基准迁移: 厂商、客户、视频和 Reddit 使用不同 prompt、工具、effort 与日期。
电脑操作安全: prompt injection、破坏性动作和虚假成功仍需权限边界、日志和人工确认。
Verdict
Claude Sonnet 4.6 仍是编码、文档和浏览器 QA 的可靠兼容模型,但它的价值不是“打败所有新模型”,而是熟悉的固定工作流可能仍能稳定产出可接受结果。Anthropic 已标为 Active (legacy),推荐更便宜的 Sonnet 5,并只给出退休下限。新系统应先基准测试 Sonnet 5;现有系统应固定 4.6、测试替代并保留回滚路径。
模型页说明 Anthropic 提供什么,固定回归样本说明迁移是否安全。
常见问题
Claude Sonnet 4.6 是什么?
Claude Sonnet 4.6 是 Anthropic 于 2026 年 2 月 17 日发布的模型,面向编码、电脑操作、长上下文推理、智能体规划、知识工作和设计。API ID 为 claude-sonnet-4-6。
Sonnet 4.6 的上下文和输出上限是多少?
核对的模型页列出 1M token 上下文和 128K 最大输出,接受文本和图像输入并输出文本;客户端和提供商可能提供更小能力。
Claude Sonnet 4.6 如何计费?
API 价格为输入每百万 token 3 美元、输出 15 美元,并有缓存读写价格;Batch API 输入和输出五折。Claude 订阅和 Tabbit 价格分开。
Sonnet 4.6 已经弃用了吗?
Anthropic 标为 Active (legacy),建议迁移到 Sonnet 5;在 Anthropic 自营平台上退休时间不早于 2027 年 2 月 17 日。Bedrock 和 Google Cloud 自行安排。
Sonnet 4.6 比 Sonnet 5 或 Opus 更好吗?
没有普遍赢家。Anthropic 把 Sonnet 5 作为当前路线,社区测试认为 4.6 在广度型审查和浏览器 QA 中仍有价值;Opus 可能在深层多跳分析中值得溢价。应测试自己的工作负载。
能在 Tabbit Browser 使用 Sonnet 4.6 吗?
本文没有用已登录 Tabbit 账户实测 Sonnet 4.6,因此不声称选择器、有效上下文、延迟或可用性。请查看实时选择器并测试可回滚流程;Tabbit 价格与 Anthropic API 价格分开。