作者表示用同一提示测试 Grok 4.6 和 Opus 5:
Grok 4.6:约 $1.74,约 5 分钟完成。
Opus 5:约 9 分钟,消耗其每日用量的 17%。
作者在结论中问读者哪个模型赢了;评论区意见并不一致,有人认为 Opus 5 质量更好,也有人认为 Grok 的速度和价格优势足以改变选择。
这不是控制变量完整的 benchmark:原始任务、模型档位、harness 和产物评分没有在主贴中完整公开。因此它更适合作为成本/速度体感案例,而不是质量排名。
当任务可以接受一次重试、且需要快速完成时,Grok 4.6 的低成本和短耗时很有吸引力;对动画、视觉细节或高质量一次交付要求更高的任务,还应单独比较产物质量。
Grok 4.6