这个帖子主要围绕 xAI/Artificial Analysis 的成绩单讨论真实使用感受。高互动评论认为 Grok 4.6 在编码上“便宜且快”,并分享了一个 Opus 负责规划、Grok 负责具体小范围修改的工作流。
另一位评论者给出相反反馈:在 Cursor 中把 Grok 4.6 与 GPT-5.6 Sol 并行运行后,认为两者仍有明显差距,并称自己已经使用 Grok 约 2 亿 tokens、Sol 约 3 亿 tokens、Opus 约 3 亿 tokens。这个反馈没有公开可复现的任务集,应视为长期用户观察,而非正式 benchmark。
帖子引用 Artificial Analysis 的“按任务成本”视图,而不是只比较每百万 token 价格。
评论者提到 Grok 4.6 的单任务成本大约与 Kimi K3 接近,另有评论认为它甚至更低。
社区普遍提醒:模型是否“话多”、重试次数、缓存命中和工具调用数量都会改变实际账单。
Grok 4.6 在开发者社区中的优势认知主要集中在速度、价格和编码可用性。
社区体验并不一致:同样在 Cursor 中,有人认为它接近前沿模型,也有人认为 Sol 的边界处理更可靠。
真实选型需要记录任务成功率、重试次数、工具调用、耗时和总成本,不能只看榜单名次。
Grok 4.6