讨论围绕“Luna 是否在性能/成本上胜过 DeepSeek V4 Flash”展开。原帖作者强调长任务中的 99.9% cache hit;回复者称 Luna 可能少用 token、速度更快,但美元消耗约为 DeepSeek 的 2–3 倍。另一位用户认为价格变化后 DeepSeek 仍更便宜,但 Luna 在 coding benchmark 上更强。结论高度依赖缓存率、订阅配额、峰谷价格和 harness。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
这是一篇非常适合用来提醒读者“不要只比较公开单价”的社区讨论。对 Tabbit 这类长上下文工作流,应实测 cache hit、首次通过率、总 token、墙钟时间和每个可接受结果的成本。
GPT-5.6 Luna