DeepSeek V4 Flash · 社区来源 · 编辑分析
Reddit 将 Artificial Analysis 历史图表解释为 Flash 0731 约 50 的指数、每个加权任务约 $0.03 的“斩杀线”。
"Kill line"(斩杀线)听起来像标题党,但图中蓝点确实配得上:
"DeepSeek V4 Flash 0731 在 Artificial Analysis 指数上大约 50 分,每次加权任务约 3 美分。这张图上,更便宜的东西分数更低,分数更高的模型都坐在右边很远的地方。 旧的 V4 F… 以上为必要节选,完整内容请查看原文。
另一个尴尬细节:当前 Pro 预览版在这张图上比 Flash 0731 还差,Pro 目前在这张图上还没有赢过任何东西。
u/StupidScaredSquirrel:如果 Pareto 线上的模型会"杀死"所有线下模型,那这张图大部分早就被其他模型杀掉了——实际上不是这么运作的,每个用例还有别的需求
u/Subject-18:OpenAI 在 Luna 降价帖里故意不提 Mimo 2.5,很好笑
u/FilterJoe:问"每次任务"到底是什么意思(是否包含重试 token、任务类型等)
"斩杀线"概念在英文社区同样流行:V4 Flash 0731 以约 3 美分/任务的成本做到约 50 的 AA 指数,价格-性能曲线上处于极左下的优势位
该帖为 r/LocalLLM 高赞帖(812 分),说明性价比认知已出圈
本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。
需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。
Reddit r/LocalLLM · u/Many-Operation2625 · 原文发布日期 Unknown · 本站编辑日期 2026-09-20
打开原始来源DeepSeek V4 Flash
下载 Tabbit 客户端后检查模型可用性