Tabbit部落格

Grok 4.6:改了什麼、成本如何、適合誰

從 500K 上下文、基準版本差異到 API 價格,協助你判斷 Grok 4.6 是否值得試用。

本文目錄
  1. 先看結論
  2. 规格与获取
  3. 相对 Grok 4.5 的变化
  4. 先看結論:证据边界
  5. 社区观察与场景自检
  6. 下一步与 Verdict
  7. Sources

Grok 4.6 值得在知識工作、長流程智慧體和視覺建置中試用,但不是自動的程式設計贏家:終端基準版本、推理 token 成本和路線限制更重要。

xAI 於 2026 年 8 月 12 日發布 Grok 4.6。2026 年 9 月 20 日核對的 API 為 500K 上下文、每百萬輸入/輸出 token 2/6 美元。Artificial Analysis 的獨立快照是 Index 61、約 0.84 美元/任務,這是方法限定的規劃指標。(xAI文档独立分析

先看結論

  • 官方定位長流程智慧體、程式設計、知識和互動任務。目前文件列出可設定推理、文字/圖片輸入與 2026-02-01 知識截止。xAI 的 Terminal-Bench v3.0 為 26%,獨立分析的 v2.1 為 88.4%,不能合併。

  • 基礎 API 價格為每百萬輸入/輸出 token 2/6 美元;快取、快速版本、工具、重試和供應商會改變實際成本。

  • 本稿没有完成 Tabbit Grok 4.6 任务或截图,请先查看 Grok 4.6 模型资源 (简体中文)

规格与获取

项目当前快照决策边界
模型grok-4.6,2026-08-12 发布固定模型 ID 和供应商路线。
上下文500K token客户端和配额可能更小。
输入/输出文本、图片输入;文本输出工具与图片限制取决于路线。
推理可配置同时比较档位、token 和验收率。
知识截止2026-02-01当前事件要使用 Web Search/X Search。
API 价格输入 2 / 输出 6 美元/百万 token缓存、快速版本和供应商改变成本。
入口API、Grok Build、合作方;Cursor 在发布时提供确认账号、地区、方案和配额。

相对 Grok 4.5 的变化

维度Grok 4.5Grok 4.6建议
定位通用前沿模型长流程智能体和交互任务测完整工作流。
xAI 指数5661这是定日期快照。
训练旧配方更长补充训练和智能体 RL不外推所有任务。
验证早期行为xAI 称自测更多保留自己的测试。

先看結論:证据边界

官方定位長流程智慧體、程式設計、知識和互動任務。目前文件列出可設定推理、文字/圖片輸入與 2026-02-01 知識截止。xAI 的 Terminal-Bench v3.0 為 26%,獨立分析的 v2.1 為 88.4%,不能合併。 xAI 发布表的 Terminal-Bench v3.0 为 26%;Artificial Analysis 的 Terminal-Bench v2.1 为 88.4%,版本、harness 和停止规则不同。BenchLM是另一份 9 月聚合快照。不要把不同表格合成单一排名。

社区观察与场景自检

Cursor 同任務比較用 Grok Extra High 與 Sol Medium 處理約 2,500 行後端,作者約 60/40 偏向 Sol;也有人認為 Grok 較好,還有人提醒複雜任務會循環耗 token。這些是社群線索,不是受控測試。 第二个 Reddit 讨论同样有赞成和怀疑。X 搜索只显示登录外壳,没有稳定可归属的原帖;YouTube 只显示搜索结果标题,因此没有把它们当作硬证据。

场景第一步不能外推的地方
长文档、知识工作有来源和停止条件的可回滚任务不能由排行榜保证事实准确。
多文件编程固定同一 fixture 与现有模型对比终端表现依赖版本和工具。
视觉/交互原型小项目、检查成品本轮没有 Tabbit 实测。
浏览器工作阅读智能体浏览器指南并核验权限模型不会自动提供认证。

下一步与 Verdict

選擇可回復任務,記錄模型 ID、推理、供應商、token、延遲、工具、重試和人工修正,再與現有模型比較。參考智慧體瀏覽器自動化Tabbit瀏覽器比較最佳瀏覽器實踐提示詞 (简体中文)評測 (简体中文)

Tabbit Browser

Grok 4.6 值得受控试用,但不应凭一个排行榜切换。固定模型和推理档位,使用可回滚样例和验收检查,让实际完成任务成本与人工介入决定它是否长期保留。

本文前置元数据中的六个 FAQ 分别回答模型定义、价格、相对 4.5 的变化、获取、编程适配度和是否切换。

Sources

常見問題

Grok 4.6 是什麼?

Grok 4.6 值得在知識工作、長流程智慧體和視覺建置中試用,但不是自動的程式設計贏家:終端基準版本、推理 token 成本和路線限制更重要。

Grok 4.6 多少錢?

xAI 於 2026 年 8 月 12 日發布 Grok 4.6。2026 年 9 月 20 日核對的 API 為 500K 上下文、每百萬輸入/輸出 token 2/6 美元。Artificial Analysis 的獨立快照是 Index 61、約 0.84 美元/任務,這是方法限定的規劃指標。

4.5 更新了什麼?

官方定位長流程智慧體、程式設計、知識和互動任務。目前文件列出可設定推理、文字/圖片輸入與 2026-02-01 知識截止。xAI 的 Terminal-Bench v3.0 為 26%,獨立分析的 v2.1 為 88.4%,不能合併。

在哪裡使用?

xAI API、Grok Build 和合作方提供路线,实际访问取决于账号、地区和配额。

適合程式設計嗎?

请用固定 fixture、测试与 diff 审核验证编程适配度。

應該切換嗎?

固定模型和推理设置,用相同任务比较完成成本和人工修正。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。