Artificial Analysis 把 Claude Sonnet 4.6(Non-reasoning, High Effort)放在同类非推理模型里 Intelligence Index 37、约 46 tok/s、输入 $3 / 输出 $15 / 百万 token,并标明 1M 上下文;页面同时提示该模型已 deprecated,智能分数不再代表最新 Sonnet。
展示配置:Claude Sonnet 4.6,Non-reasoning,Effort high。
指数版本:Artificial Analysis Intelligence Index v4.1.1,含 GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR。
比较池:页面写明非推理模型只与其他非推理模型比;定价带与同类 >$1/1M blended 的专有模型比较。
维护状态:This model is deprecated. 只继续默认 10k 输入 token 负载的性能基准,其他负载结果为历史值。建议考虑 Claude Sonnet 5 (Non-reasoning)。
页面展示的是非推理 + high effort 变体,不是 reasoning 变体。输入模态 text+image,输出 text,上下文 1M。具体逐项评测的 prompt 与 harness 见 AA 的 Intelligence Index methodology,不在该模型页全文展开。
采集时模型摘要:
| 指标 | 页面值 |
|---|---|
| Intelligence Index | 37(该类 #5 / 63;同类中位数 23) |
| 速度 | 46.1 output tok/s(该类 #36 / 63;页面称 notably slow) |
| 输入价 | $3.00 / 百万 token |
| 输出价 | $15.00 / 百万 token |
| Cache discount | 90% |
| Cost per Intelligence Index task | N/A |
| Verbosity | N/A |
| 上下文 | 1M tokens |
同页 Intelligence 对照条(节选,越高越好):Claude Opus 5 (max) 63、Claude Fable 5 62、GPT-5.6 Sol (max) 61、…、Claude Sonnet 4.6 (Non-reasoning) 37。速度对照里 Sonnet 4.6 为 46 tok/s,低于多数列出的对照模型。
页面文案:在智能上属于领先非推理模型之一,但相对同价位非推理模型偏贵;支持 text/image 输入。
用 AA 的口径,Sonnet 4.6 非推理高 effort 仍明显强于该类中位数,但已经不是 2026-08 的智能前沿,速度也偏慢。适合作为“已知单价、1M 窗口、非推理”的生产对照,不适合再当最新 Sonnet 的代理。需要 reasoning 变体分数时,必须打开 AA 的 reasoning 页面,不能用本页 37 分代替。
页面明确 deprecated,部分工作负载不再更新。
本页是 Non-reasoning High Effort,与官方默认 effort、以及开启 thinking 的结果都不可混用。
Cost per task 与 verbosity 为 N/A,不能从本页推断单位任务美元。
Intelligence Index 是 9 项合成,不能还原成 SWE 或 OSWorld。
固定 AA 的 v4.1.1 方法,明确要跑 non-reasoning 还是 reasoning。
设置 claude-sonnet-4-6 且 effort=high,关闭 reasoning。
分别记录 Index 分项、tok/s、延迟和 $3/$15 实际账单。
与 Sonnet 5 非推理对照时使用 AA 当前仍更新的页面,而不是本 deprecated 页的历史负载。
Claude Sonnet 4.6