"Kill line"(斩杀线)听起来像标题党,但图中蓝点确实配得上:
"DeepSeek V4 Flash 0731 在 Artificial Analysis 指数上大约 50 分,每次加权任务约 3 美分。这张图上,更便宜的东西分数更低,分数更高的模型都坐在右边很远的地方。 旧的 V4 F… 以上为必要节选,完整内容请查看原文。
另一个尴尬细节:当前 Pro 预览版在这张图上比 Flash 0731 还差,Pro 目前在这张图上还没有赢过任何东西。
u/StupidScaredSquirrel:如果 Pareto 线上的模型会"杀死"所有线下模型,那这张图大部分早就被其他模型杀掉了——实际上不是这么运作的,每个用例还有别的需求
u/Subject-18:OpenAI 在 Luna 降价帖里故意不提 Mimo 2.5,很好笑
u/FilterJoe:问"每次任务"到底是什么意思(是否包含重试 token、任务类型等)
"斩杀线"概念在英文社区同样流行:V4 Flash 0731 以约 3 美分/任务的成本做到约 50 的 AA 指数,价格-性能曲线上处于极左下的优势位
该帖为 r/LocalLLM 高赞帖(812 分),说明性价比认知已出圈
DeepSeek V4 Flash