查看所有模型

在 Tabbit 中使用 Claude Sonnet 4.6

在 Tabbit 中使用

在 Tabbit 中使用 Claude Sonnet 4.6

Claude Sonnet 4.6 · 模型速览

先看资源与证据,再决定怎么用

这里集中放置已审核的任务指南、公开测评和证据边界。客户端是否开放模型,仍以当前账户为准。

任务指南9
测评来源11
来源已核对0
编辑精选8

Tabbit 模型与权限需以当前账户核实。

模型深度阅读

总览 · 简体中文

Claude Sonnet 4.6 是什么:价格、获取方式与 Sonnet 5 迁移问题

用来源说明 Claude Sonnet 4.6 的 1M 上下文、$3/$15 API 价格、Active legacy 状态、访问入口和迁移取舍。

阅读全文

按任务找指南

把资料整理成结构化结果,制作视觉原型,或开始一个编码任务。

全部提示词与工作流
写作 · Agent 工作流未核验

Claude Sonnet 4.6 的清晰指令、XML 上下文与自检提示

按“Claude Sonnet 4.6 的清晰指令、XML 上下文与自检提示”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。

准备输入
任务相关文件、工具白名单与权限、输出 schema、验收证据
运行环境
Claude API、Claude Code 或兼容 Anthropic 的运行器
查看步骤
写作 · Agent 工作流未核验

Claude Sonnet 4.6 的 Computer Use 工具定义与自动化闭环工作流

按“Claude Sonnet 4.6 的 Computer Use 工具定义与自动化闭环工作流”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。

准备输入
任务相关文件、工具白名单与权限、输出 schema、验收证据
运行环境
Claude API、Claude Code 或兼容 Anthropic 的运行器
查看步骤
写作 · Agent 工作流未核验

Claude Sonnet 4.6 的 1M 长上下文与 Context Compaction 架构配置

按“Claude Sonnet 4.6 的 1M 长上下文与 Context Compaction 架构配置”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。

准备输入
任务相关文件、工具白名单与权限、输出 schema、验收证据
运行环境
Claude API、Claude Code 或兼容 Anthropic 的运行器
查看步骤
Agent 工作流 · 编程未核验

Claude Code 下 Sonnet 4.6 的多智能体协作与工程开发工作流

按“Claude Code 下 Sonnet 4.6 的多智能体协作与工程开发工作流”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。

准备输入
任务相关文件、工具白名单与权限、输出 schema、验收证据
运行环境
Claude API、Claude Code 或兼容 Anthropic 的运行器
查看步骤

阅读证据与选型边界

公开结果来自不同版本、档位和测试方法;未知值保持未知。

全部测评与来源
Anthropic News / Introducing Sonnet 4.6厂商自报

Claude Sonnet 4.6 官方发布:编码、电脑使用与 Agent 基准

Anthropic 的发布数据把 Sonnet 4.6 定位为较低成本的 Opus 级候选:SWE-bench、OSWorld、OfficeQA、金融 Agent 和长上下文表现强,但极深推理、复杂搜索和高难重构仍建议考虑 Opus 4.6。

证据类型
厂商自报
边界
1M context 为 beta,且长上下文价格/平台限制可能不同。
OSWorld Benchmark Leaderboard / Evaluation Suite编辑分析

OSWorld-Verified 独立评测:Claude Sonnet 4.6 计算机操作与 GUI 任务深度分析

在标准 Ubuntu 桌面评测套件 OSWorld-Verified 中,Claude Sonnet 4.6 取得了 72.5% 的任务成功率,逼近旗舰 Opus 4.6(72.7%),但在高频复杂动态弹窗及多层级右键菜单场景下仍存在一定的视觉定位抖动。

证据类型
编辑分析
边界
失败模式集中:主要失败集中在:1) 页面微小像素级下拉箭头点击偏移(占比约 35% 的失败);2) 突发异步网络加载慢导致的动作抢跑;3) 软件快捷键冲突未触发。
Artificial Analysis独立测量

Artificial Analysis:Sonnet 4.6 非推理 Intelligence Index 37

Artificial Analysis 把 Claude Sonnet 4.6(Non-reasoning, High Effort)放在同类非推理模型里 Intelligence Index 37、约 46 tok/s、输入 $3 / 输出 $15 / 百万 token,并标明 1M 上下文;页面同时提示该模型已 deprecated,智能分数不再代表最新 Sonnet。

证据类型
独立测量
边界
Cost per task 与 verbosity 为 N/A,不能从本页推断单位任务美元。

Anthropic

在 Tabbit 中使用 Claude Sonnet 4.6

汇总 Claude Sonnet 4.6 的提示词指南、测评与社区反馈,帮助你判断适合的任务并直接开始使用。