查看所有模型

在 Tabbit 中使用 Claude Sonnet 4.6

在 Tabbit 中使用

在 Tabbit 中使用 Claude Sonnet 4.6

精选提示词

查看全部提示词
媒体Claude Platform Docs / Prompting best practices

Claude Sonnet 4.6 的清晰指令、XML 上下文与自检提示

用清晰的顺序化要求、XML 分隔上下文与示例,并要求按验收标准自检,能让 Claude Sonnet 4.6 在文档分析、代码和多步任务中更稳定地保持范围与格式。

媒体Claude Platform Docs / Effort 与 Prompting best practices

Claude Sonnet 4.6 的 effort 与工具触发配置

Sonnet 4.6 的 effort 会同时影响文本、思考和工具调用 token;官方建议多数生产应用从 medium 起步并显式设置,避免默认 high 带来的不可预测延迟。

媒体Anthropic Platform Docs / Computer Use API Reference

Claude Sonnet 4.6 的 Computer Use 工具定义与自动化闭环工作流

通过标准化的 computer20260124、bash20260124 和 texteditor20260124 工具定义,结合“观察-定位-行动-验证”闭环系统提示,使 Claude Sonnet 4.6 能够高精度执行桌面与浏览器跨应用自动化。

媒体Anthropic Platform Docs / Context Management & Compaction

Claude Sonnet 4.6 的 1M 长上下文与 Context Compaction 架构配置

通过配置 Prompt Caching 缓存点与 Context Compaction 滚动压缩策略,使 Claude Sonnet 4.6 在 1M token 巨量上下文或超长轮次 Agent 任务中,既维持全局记忆与精准召回,又显著降低延迟与重算成本。

社区GitHub / Claude Code Architecture & Best Practices

Claude Code 下 Sonnet 4.6 的多智能体协作与工程开发工作流

在大型代码仓库中,通过配置“架构规划(Planner)- 分支实现(Worker)- 独立验证(Tester)”三阶段 Subagent 工作流,让 Sonnet 4.6 在隔离上下文内并行推进模块开发,避免上下文污染与幻觉扩散。

媒体Claude Code Docs / Model configuration

Claude Code 用 opusplan 规划、Sonnet 4.6 执行的固定配置

把 Claude Code 设成 opusplan,规划用 Opus、落地用 Sonnet,并把 ANTHROPICDEFAULTSONNETMODEL 钉死为 claude-sonnet-4-6,才能避免 sonnet 别名在不同云平台解析成 Sonnet 5 或 4.5。

测评与真实反馈

查看全部测评
媒体Anthropic News / Introducing Sonnet 4.6

Claude Sonnet 4.6 官方发布:编码、电脑使用与 Agent 基准

Anthropic 的发布数据把 Sonnet 4.6 定位为较低成本的 Opus 级候选:SWE-bench、OSWorld、OfficeQA、金融 Agent 和长上下文表现强,但极深推理、复杂搜索和高难重构仍建议考虑 Opus 4.6。

媒体BenchLM

BenchLM 对 Claude Sonnet 4.6 的公开证据账本

BenchLM 的可展示来源账本给 Sonnet 4.6 记录 22 行 benchmark:SWE-bench Verified 79.6%、OSWorld-Verified 72.1%、Terminal-Bench 59.1%、GPQA 89.9%,同时显示不同类别强弱差异,适合做复核入口而非单一总分。

媒体IDP Leaderboard

IDP Leaderboard:Sonnet 4.6 在真实文档理解上与 Opus 4.6 持平

在开放文档 AI 排行榜上,Claude Sonnet 4.6 总分 80.7,略高于 Opus 4.6 的 80.4,适合把 OCR、表格、版式和关键信息抽取从 Opus 下放到 Sonnet;归档扫描件仍要防内容审核误拦。

媒体Artificial Analysis

Artificial Analysis:Sonnet 4.6 非推理 Intelligence Index 37

Artificial Analysis 把 Claude Sonnet 4.6(Non-reasoning, High Effort)放在同类非推理模型里 Intelligence Index 37、约 46 tok/s、输入 $3 / 输出 $15 / 百万 token,并标明 1M 上下文;页面同时提示该模型已 deprecated,智能分数不再代表最新 Sonnet。

媒体Sansa Bench(trysansa.com)

Sansa Bench:Sonnet 4.6 高推理总体 0.733,当前排第 4

Sansa Bench 当前总榜把 Claude-Sonnet-4.6 Reasoning High 记为 0.733,并列/紧随 Gemini-3.1-Pro-Preview Reasoning Low,低于 Opus 5 / 4.8 高推理;它适合看“开推理后的综合能力”,不适合直接引用 6 个月前 Reddit 帖里的旧分数。

Anthropic

在 Tabbit 中使用 Claude Sonnet 4.6

汇总 Claude Sonnet 4.6 的提示词指南、测评与社区反馈,帮助你判断适合的任务并直接开始使用。