帖子汇总了三档模型的价格与多个 benchmark,并给出路由建议:Terra 作为多数工作负载默认模型,Sol 留给最难的 agent/terminal 任务,Luna 用于高频流水线。帖子同时引发了关于幻觉、订阅额度和“benchmark 是否代表真实体验”的讨论。
帖子原始价格:Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百万输入/输出 token;后续价格已有变化,不能当作当前价格)。
Terminal-Bench 2.1:Sol 88.8%、Terra 87.4%、Luna 84.7%。
AA Coding Agent Index:Sol 80、Terra 77.4、Luna 74.6。
DeepSWE value:帖子称 Luna 每 1 美元约 24 分,Opus 4.8 约 4.5 分。
讨论区有人指出,实际使用中 Sol 可能出现幻觉,也有人认为 Luna Max 接近 Sol Medium,但速度和效率不完全相同。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
GPT-5.6 Luna