如果你在搜索“DeepSeek V4 Flash 价格”,先做一个身份确认:截至 2026 年 9 月 10 日,旧版 V4 Flash 已下线。deepseek-v4-flash 仍可作为兼容名称使用,但请求会被路由到 DeepSeek-V4.1-Flash。新 API 应使用 deepseek-flash,预算也必须采用 V4.1 Flash 的价格卡,而不是旧文章里的 7 月价格。
这就是很多价格摘要没有回答的问题:名称保留了,模型和计费卡没有保留。你可以先查看 DeepSeek V4 Flash 模型页、提示词列表 和测评证据。如果你的目标是浏览器工作流,Tabbit 是独立的访问路径,不等于 DeepSeek API 账户。
先看结论
新 API 使用
deepseek-flash;deepseek-v4-flash是临时兼容别名。闲时价格为缓存命中输入 $0.003、未命中输入 $0.15、输出 $0.60,均按每百万 token 计算。
高峰价格分别是 $0.006、$0.30 和 $1.20;高峰时段是周一至周五 UTC 01:00–04:00、06:00–10:00。
缓存命中必须有已持久化且匹配的前缀,长上下文不等于自动低价。
任务成本还包括重试、工具调用、修复和人工审核。
当前价格一览
以下数据来自 DeepSeek 官方价格文档,采集于 2026-09-20。单位为每百万 token。
| 项目 | 闲时 | 高峰 | 说明 |
|---|---|---|---|
| 输入,缓存命中 | $0.003 | $0.006 | 已持久化且匹配的前缀 |
| 输入,缓存未命中 | $0.15 | $0.30 | 新输入或前缀不匹配 |
| 输出 | $0.60 | $1.20 | 包括适用时的推理输出 |
| 高峰时段 | — | UTC 01:00–04:00、06:00–10:00,周一至周五 | 其余为闲时 |
| 上下文 / 并发 | 1M / 2,500 | 1M / 2,500 | 上限,不是速度保证 |
当前 API 模型是 deepseek-flash,对应 V4.1 Flash。官方价格表列出思考与非思考模式、JSON、工具调用、Responses API、Anthropic API 和视觉支持。旧名暂时路由到新模型,不代表旧模型仍可使用。
变化最大的不是小数,而是别名
7 月 31 日的更新仍要求开发者使用 deepseek-v4-flash。9 月 10 日的官方更新日志宣布 V4.1 Flash 上线,并将旧名改为兼容路由。代码可以继续工作,但原来的成本假设已经可能失效。
因此,看到 model: "deepseek-v4-flash" 不能证明你仍在运行 7 月模型;文章里的 $0.14 输入或 $0.28 输出也不能直接当成今天的预算。保存模型名、费率采集日期和峰谷时段,迁移后重新核算。
缓存命中才是主要杠杆
官方缓存说明显示,缓存默认开启,但必须有此前持久化并完全匹配的前缀。长上下文不等于自动低价。
单次成本 = 缓存命中输入 × 命中价 ÷ 1,000,000
+ 缓存未命中输入 × 未命中价 ÷ 1,000,000
+ 输出 × 输出价 ÷ 1,000,000月度预算还要乘以请求数,再单独加入重试和工具调用。日志中保留三个 token 桶;如果供应商返回 prompt_cache_hit_tokens,直接使用它,不要凭感觉估算命中比例。
两个可复算的预算
| 工作负载 | 假设 | 闲时估算 | 高峰估算 | 不含 |
|---|---|---|---|---|
| 短文本抽取 | 80 万命中输入 + 20 万未命中输入 + 10 万输出 | $0.0924 | $0.1848 | 重试、工具、税费、代理商加价 |
| 长 Agent 循环 | 900 万命中输入 + 100 万未命中输入 + 50 万输出 | $0.477 | $0.954 | 失败任务、额外工具、人工监督 |
短任务的闲时计算是 0.8 × 0.003 + 0.2 × 0.15 + 0.1 × 0.60 = $0.0924。长循环为 9 × 0.003 + 1 × 0.15 + 0.5 × 0.60 = $0.477。在官方时段定义下,高峰费用正好翻倍。
本地计算
估算 DeepSeek Flash token 成本
使用 2026-09-20 核对的 V4.1 Flash 官方费率。输入值仅在浏览器本地处理。
不含重试、工具、税费、代理商加价和人工审核。 核对最新费率
计算器完全在当前浏览器中运行,使用 2026-09-20 核对的 V4.1 Flash 官方费率,不会上传输入值。结果不含重试、工具调用、税费、代理商加价和人工审核;正式预算前请再次查看官方价格卡。
价格表没有告诉你的事
高峰调度适合排队评测、夜间索引和非紧急任务,但不会消除并发限制。价格便宜也不会自动解决失败重试、排队时间和人工修复的成本。
社区实际支付与使用反馈
社区报告说明了账单之外的取舍。一位 Reddit 用户称 11,500 次 API 请求花了 $4.12;另一位用户称模型把五小时任务缩短到一小时、成本约 $1.63,并记录在复杂工作流讨论中。相反,LocalLLaMA 用户认为规则和 skills 的遵循仍是主要问题;另一条 DeepSeek 讨论同时称赞调试能力并担心容量变化。AICodeKing 的 YouTube 实测报告了 7 月 31 日的一次 $0.14 任务。它们都是 2026 年 7–8 月的个人经验,不能证明当前 V4.1 价格、容量或普遍性能。
高峰调度对排队评测、夜间索引和非紧急任务有用,但不会消除并发限制。官方限流文档列出 deepseek-flash 的账户级并发上限 2,500。
如果你需要 API key、token 日志和重试策略,就按 API 预算。如果你需要打开网页、保留研究标签并进行人工复核,Agentic reasoning和 DeepSeek Harness 浏览器插件是另一类问题。不要把浏览器产品费用套入 API 公式。
按工作负载选择
| 场景 | 起点 | 原因 | 先检查 |
|---|---|---|---|
| 长前缀、可排队、时间灵活 | 直接 API + 缓存日志 | 闲时和命中可以叠加节省 | 前缀稳定性、重试率、本地高峰时间 |
| 需要人工复核的网页研究 | 支持该模型的浏览器,例如 Tabbit Browser | 页面、标签和模型保持在一起 | 产品可用性和条款,不等于 API 计费 |
| 图像输入 | V4.1 Flash 或已核实的多模态路径 | 当前官方文档列出视觉支持 | 请求时确认 model ID 和模态 |
| 规则复杂且错误代价高 | 固定样本试跑 + 更强模型复核 | 低 token 费不等于低修复成本 | 成功标准、人工时间、回退方案 |
用 Tabbit 做浏览器侧尝试
如果目标是对网页执行任务,而不是维护 API 账单,可以在模型工作区中查看当前选择器是否提供 DeepSeek V4 Flash,再使用提示词集合。AI 浏览器比较和Agentic browser 说明可以帮助你判断浏览器路径是否适合。
边界仍然重要:Tabbit 的可用性、产品条款和 DeepSeek API 价格彼此独立。选择模型不会自动创建你的 API 账单,拥有 API key 也不会自动获得浏览器功能。
最终判断
当任务有重复前缀、时间灵活且成功标准可量化时,DeepSeek V4 Flash 的价格很有吸引力。正确的第一步不是套用旧费率,而是确认请求现在运行的是 V4.1 Flash,分开缓存命中和未命中,并记录峰谷时段。
正式预算前请重查官方价格页。如果下一步是浏览器任务,先在 DeepSeek 模型页确认你的版本和账户是否可用。
Sources
当前价格、峰谷时段和别名路由来自官方价格文档、V4.1 Flash 发布说明、更新日志、缓存指南和限流文档,均于 2026-09-20 核对或采集。社区来源包括 DeepSeek 体验帖、奖励模型账单帖、LocalLLaMA 规则反馈、复杂任务讨论和 AICodeKing YouTube 实测。这些均为有日期的个人测试,不是当前价格、容量或性能的独立证明。
常见问题
deepseek-v4-flash 还是当前的 Flash 模型吗?
不是。DeepSeek 在 2026 年 9 月 10 日下线旧版 V4 Flash,旧名称暂时作为兼容别名路由到 V4.1 Flash。新 API 调用应使用 deepseek-flash。
DeepSeek V4.1 Flash 怎么收费?
闲时每百万缓存未命中输入 token 为 0.15 美元,输出为 0.60 美元。高峰时段分别为 0.30 美元和 1.20 美元;缓存命中输入为 0.003 或 0.006 美元。
DeepSeek Flash 的高峰时段是什么时候?
官方定义为周一至周五 UTC 01:00–04:00 和 06:00–10:00。其他时段是闲时,但安排任务前应换算为自己的本地时间。
缓存命中如何影响账单?
只有此前持久化且匹配的输入前缀才按缓存命中价计费。上下文很长不代表一定命中,命中率取决于请求前缀和请求边界。
可以按 token 估算月度预算吗?
可以,但要分开统计缓存命中输入、未命中输入和输出 token。各自乘以对应费率再除以一百万,并另外加入重试和工具调用的成本。
在 Tabbit 里使用 DeepSeek 会扣 DeepSeek API 余额吗?
不会。Tabbit 产品会话与 DeepSeek API 账户是两条独立的访问和计费路径。请以产品内模型选择器和相应条款为准。