Claude Sonnet 4.6 的清晰指令、XML 上下文与自检提示
按“Claude Sonnet 4.6 的清晰指令、XML 上下文与自检提示”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。
- 准备输入
- 任务相关文件、工具白名单与权限、输出 schema、验收证据
- 运行环境
- Claude API、Claude Code 或兼容 Anthropic 的运行器

在 Tabbit 中使用 Claude Sonnet 4.6
Claude Sonnet 4.6 · 模型速览
这里集中放置已审核的任务指南、公开测评和证据边界。客户端是否开放模型,仍以当前账户为准。
Tabbit 模型与权限需以当前账户核实。
把资料整理成结构化结果,制作视觉原型,或开始一个编码任务。
按“Claude Sonnet 4.6 的清晰指令、XML 上下文与自检提示”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。
按“Claude Sonnet 4.6 的 Computer Use 工具定义与自动化闭环工作流”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。
按“Claude Sonnet 4.6 的 1M 长上下文与 Context Compaction 架构配置”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。
按“Claude Code 下 Sonnet 4.6 的多智能体协作与工程开发工作流”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。
公开结果来自不同版本、档位和测试方法;未知值保持未知。
Anthropic 的发布数据把 Sonnet 4.6 定位为较低成本的 Opus 级候选:SWE-bench、OSWorld、OfficeQA、金融 Agent 和长上下文表现强,但极深推理、复杂搜索和高难重构仍建议考虑 Opus 4.6。
在标准 Ubuntu 桌面评测套件 OSWorld-Verified 中,Claude Sonnet 4.6 取得了 72.5% 的任务成功率,逼近旗舰 Opus 4.6(72.7%),但在高频复杂动态弹窗及多层级右键菜单场景下仍存在一定的视觉定位抖动。
Artificial Analysis 把 Claude Sonnet 4.6(Non-reasoning, High Effort)放在同类非推理模型里 Intelligence Index 37、约 46 tok/s、输入 $3 / 输出 $15 / 百万 token,并标明 1M 上下文;页面同时提示该模型已 deprecated,智能分数不再代表最新 Sonnet。
Anthropic
汇总 Claude Sonnet 4.6 的提示词指南、测评与社区反馈,帮助你判断适合的任务并直接开始使用。