DeepSeek V4 Flash 模型测评导航
汇总 DeepSeek V4 Flash 的官方基准、媒体分析和社区实测,不把第三方观点包装成 Tabbit 自测。
官方
2 条已核对来源的资料DeepSeek-V4-Flash:0731 更新基准与 Harness 条件
官方 0731 更新显示 V4-Flash 的 Agent 基准明显高于 V4-Pro-Preview,但结果依赖 DeepSeek Harness minimal mode 与 max effort,比较时必须把 harness 和参数一起复现。
DeepSeek V4 Flash Review (2026) — Specs, Tests & Speed
规格与价格(截至 2026-07-25 验证) DeepSeek V4 Flash(轻量档)· model id: deepseek-v4-flash 规模:284B 总参数 · 13B 激活参数 上下文:1M tokens · 最大输出 384K。
媒体
5 条已核对来源的资料DeepSeek-V4-Flash:本地部署量化与 Agent 实测
V4-Flash 的本地运行可行性取决于多 GPU/量化与上下文余量,Open Code 的两个小型 Agent 项目表现连贯但仍出现真实数据错误,部署决策不能只看 benchmark 或 token 价格。
DeepSeek V4 Alters Everything We Knew About Price-Performance Math(Lightning AI)
DeepSeek 发布两款开源模型 V4-Pro 和 V4-Flash,已在全球生产环境运行(包括 Lightning AI 内部)。Lightning AI 优化工程师的初评:"编码是我主要用途——它很好。"。
DeepSeek V4 Flash 0731 Benchmarks, Pricing & Speed(BenchLM)
API model id:deepseek-v4-flash(0731 更新版) 发布:2026 年 7 月 31 日;类型:Proprietary / Reasoning 上下文窗口:1M;输入模态:text;输出模态:text。
DeepSeek V4 Flash 第三方聚合平台数据(Command Code / flaq.ai / OpenRouter / benchlm 补充)
Command Code:DeepSeek V4 Flash (latest) 数据卡 模型 ID:deepseek/deepseek-v4-flash(fast hybrid-attention reasoning) 命令:cmd --model deepseek/deepseek-v4-flash。
DeepSeek V4-Flash 正式版来了!AI 开发者实测:价格"很香" Agent 能力直追顶级模型
月 31 日,DeepSeek 官宣 DeepSeek-V4-Flash 正式版 API 开启公测,大幅升级代理能力,正式版基准测试得分远超 V4-Pro 预览版。Agent 智能体终极测试中,V4-Flash 正式版得分 25.2 分,接近 Opus-4.8 的 25.7 分,远高于 V4-Pro 预览版 15.8 分。
社区
17 条已核对来源的资料302.AI 基准实验室丨打破"轻量版"标签,DeepSeek-V4-Flash 实测:低成本挑战顶级 Agent
DeepSeek-V4-Flash 正式版上线!后训练让 Agent 与编程能力飙升,综合能力超过 V4 Pro。百万 Token 输入仅 1 元的"地板价"彻底刷新 Agent 门槛。
什么是 DeepSeek 斩杀线?DeepSeek-V4-Flash 第一手测评来了!
"DeepSeek 斩杀线"是近期 AI 开发者圈的新词,以 DeepSeek-V4-Flash 为标杆: 性能不如它、调用成本更高的模型 → 完全丧失商用价值,被市场淘汰 性能小幅超越它、但定价贵数倍到数十倍的高端模型 → 丢掉 90% 大众化商用场景。
DeepSeek V4 逻辑测评
V4 Pro 作为万亿参数模型,与 Seed 2.0 Pro、Kimi K2.6 在第一梯队头部会师,以显著优势拿到国产模型第一;但 max 档位推理开销显著更高 V4 Flash 以 200B+ 级别体量与尺寸相近的 Hy3 在第一梯队尾部相遇;V4 Flash 定价更低,但综合成本与 Hy3 持平,二者互有胜负。
DeepSeek V4 模型的 Agent 能力实测
CowAgent 作为开源中立的 Agent 框架,关注模型在 Agent 链路中的真实表现(工具调用、长上下文、长期记忆、浏览器自动化、知识组织),用 6 个真实场景全面测试 DeepSeek V4 模型,本次评测主要关注 deepseek-v4-flash。
DeepSeek V4 Flash at $0.112/M output after the price increase(Reddit r/DeepSeek)
在 DeepSeek 新定价生效后,InferX 分享其 V4 Flash 替代价格方案: "在 DeepSeek 新定价生效后,想给大量跑 V4 Flash 的人分享一个替代方案。我们在 InferX 上提供 DeepSeek V4 Flash: - 输入:$0.056 / 1M tokens - 输出:$0.1…。
DeepSeek V4 Flash doesn't like us?(Reddit r/opencodeCLI)
"在最新一次涨价之后,我只改了 10 行代码,就莫名其妙用了 28% 的配额。然后我写了一条 commit message,它跳到了 32%。现在感觉哪怕只是想想运行 go build 一分钟,都会再烧掉一大块用量。😅…。
DeepSeek V4 Flash is a monster! Cheap & Good, and so fast(Reddit r/opencodeCLI)
作者此前重度使用 Claude,工作中用 GPT/Codex(via OpenCode)。Claude 订阅到期后,转而用国产模型全面替代: 主力是 MiniMax,配 Kimi 理解截图(复制粘贴方式),但有时会卡住 小米模型不错但慢且贵;deepseek v4 pro 好但慢、低效、贵。
DeepSeek V4 Flash just drew a pretty brutal "kill line" on this chart(Reddit r/LocalLLM)
"Kill line"(斩杀线)听起来像标题党,但图中蓝点确实配得上: "DeepSeek V4 Flash 0731 在 Artificial Analysis 指数上大约 50 分,每次加权任务约 3 美分。这张图上,更便宜的东西分数更低,分数更高的模型都坐在右边很远的地方。 旧的 V4 F…。
DeepSeek V4-Flash/Pro 实测报告:从购买到实战,性价比天花板级国产大模型体验
作者因 Cursor/Kiro 免费版限制,直接入手 DeepSeek 官方 API,亲测 V4-Flash 和 Pro 两款模型,从充值、配置到实战写代码、排 bug 全程踩坑。
DeepSeek-V4-Flash 使用体验:强大模型如何真正帮你完成工作?
能力强:推理、代码和 Agent 任务明显提升。DeepSWE 软件工程测试中,DeepSeek-V4-Flash 成绩从 7.3 分提升到 54.4 分(提升超 7 倍),整体表现超过 GLM-5.2 等国产编程模型 原生支持百万级上下文窗口:一整本技术文档、一个完整代码仓库、几十页研究资料可一次交给模型分析。
I ran DeepSeek V4 Flash on 8 agent harnesses(Reddit r/DeepSeek)
作者认为 model-harness fit(模型与框架的适配度)是真实存在的:同一模型在不同 harness 上表现差异巨大。日常用 OpenCode 和 Hermes 驱动 DeepSeek V4 Flash,成本差异明显,于是用 DeepSeek V4 Flash(via OpenRouter)在 8 个流行 harness 上跑基准:25 个涉及多应用(Slack、Sheets、Gmail、PostHog 等)的真实自动化任务。
Tested Deepseek v4 flash with some large code change evals(Reddit r/LocalLLaMA)
作者用一些大型代码变更评估测试了 deepseek v4 flash: "用一些大型代码变更评估测试了 Deepseek v4 flash。它在使用准确性上彻底碾压!" 上下文管理、工具使用准确性和思考轨迹看起来都非常出色 是作者测试过的少数开源权重模型之一,在多工具调用或复杂原生工具定义下不会混乱。
Thank you, OpenCode! DeepSeek v4 Flash (Free) is just too good.(Reddit r/opencodeCLI)
"连续使用 DeepSeek v4 Flash (Free) 模型 5-6 小时才耗尽限额。不过它 7 小时后就会重置,所以得先睡一觉再回来继续用。 再次感谢 OpenCode!"。
What is currently the cheapest good alternative to DeepSeek V4 Flash?(Reddit r/hermesagent)
DeepSeek V4 涨价后,作者寻找 Hermes Agent 上更便宜的替代模型: "DeepSeek V4 涨价后,我在找一款能在 Hermes Agent 里用的更便宜模型。我之前用 DeepSeek V4 Flash 0731,因为它的性价比极好,但新定价后我不确定它还是不是最佳选择。 主要关注:好…。
X 用户实测:0424 与 0731 版本对比、涨价后的成本体感(Wyq / ch1lam)
@wuyiqun(Wyq):0424 版本是最爱,0731 涨价"毁了"一切 "我最喜爱的模型是 DeepSeek-V4-Flash-0424。在 0731 出来以前,几乎所有非编码任务我都交给 0424,对我来说它的智能已足够,代价只是每月几十 RMB 的账单。现在这一切都被 0731 毁了。"。
X 用户实测:一个提示修复 hypervisor 调度、本地 GPU 逆向 Chrome 扩展(jtregunna / 0xRaghuboi)
@jtregunna(Jeremy Tregunna):只用一个提示就修复了 hypervisor 调度 "deepseek v4 flash 只用一个提示就修复了我的虚拟机管理程序的客户虚拟机调度…… 这句话隐藏了它是如何成为可能的。上周末,我花了太多时间与 NPT、APIC 和一堆其他破玩意儿作斗争,我在发火之前就放弃了。 所以我给了它我调…。
X(Twitter)实测反馈汇总:涨价前后的真实用户声音
@wuyiqun(Wyq):0424 版本是最爱,0731 涨价"毁了"一切 "我最喜爱的模型是 DeepSeek-V4-Flash-0424。在 0731 出来以前,几乎所有非编码任务我都交给 0424,对我来说它的智能已足够,代价只是每月几十 RMB 的账单。现在这一切都被 0731 毁了。"。
DeepSeek V4 Flash
在 Tabbit 中使用并对比模型
汇总 DeepSeek V4 Flash 的官方基准、媒体分析和社区实测,不把第三方观点包装成 Tabbit 自测。