如果任务需要长链路规划、工具调用或大上下文,DeepSeek V4 Pro 值得小规模试用。但它不适合默认接管所有请求:当前价格分时段计算,输出可能很长,独立反馈也提到过度思考,因此路由和复核必须一起设计。
DeepSeek 在 2026 年 8 月 13 日宣布 GA。本文的决策锚点是实时目录中的 deepseek-v4-pro、版本 DeepSeek-V4-Pro-0813,以及 2026 年 9 月 20 日核对的 Artificial Analysis 快照:Intelligence Index 36,排名 7/113,每个指数任务成本 0.67 美元(max 档)。这些数字都有日期,不是永久排名。(DeepSeek GA 发布说明,Artificial Analysis)
先看结论
GA 版本增加 low、high、max 推理档位、原生 Responses API 和 Codex 接入指引。
官方目录列出 100 万 token 上下文、38.4 万 token 最大输出、工具调用和 Responses/Anthropic API;当前 API 不支持 vision。
官方价格按高峰和低峰变化。高峰输出为每百万 token 3.96 美元,低峰为 1.98 美元,预算前应重新核对。
MindStudio 八题实测给 V4-Pro-0813 打出 61/80(76.25%),预览版为 24.8%;提示词、参数和重复次数未公开。
独立证据更支持规划和前端任务,但过度工程、冗长和延迟仍是风险。
本文没有完成 Tabbit V4 Pro 实测或截图。请先查看 DeepSeek V4 Pro 模型页。
DeepSeek V4 Pro 规格速览
| 问题 | 当前快照 | 决策边界 |
|---|---|---|
| 模型 ID/版本 | deepseek-v4-pro;DeepSeek-V4-Pro-0813 | 日志中同时固定两者。 |
| 发布 | 2026-08-13 宣布 GA | 比较时保持同一版本和测试夹具。 |
| 上下文/最大输出 | 100 万 / 38.4 万 token | 目录上限不等于客户端实际额度。 |
| 推理 | low、high、max | 比较档位,而非只比较模型名。 |
| 功能 | JSON、工具调用、Responses API、Anthropic API、Chat Prefix/FIM beta | 仍取决于接入路由。 |
| 视觉 | 当前 API 表格不支持 | 图片任务需要其他模型或路由。 |
| API 价格 | 命中 0.022/0.044;未命中 0.66/1.32;输出 1.98/3.96 美元/百万 token,低峰/高峰 | 缓存、时间窗和未来调整都会改变成本。 |
| 获取 | DeepSeek API;发布说明列出网页/App Expert Mode | 仍需确认账号、地区、额度和选择器。 |
官方表格定义的高峰时段是周一至周五 UTC 01:00–04:00、06:00–10:00(中国公共假期除外),并列出 500 并发限制。它们来自动态页面,应在预算前复核。
相比 4 月预览版改了什么?
| 维度 | 4 月预览 | V4-Pro-0813 GA | 读者该怎么用 |
|---|---|---|---|
| 产品状态 | 预览讨论和早期测试 | 8 月 13 日正式发布 | 固定日期和版本。 |
| 推理控制 | 现有笔记未记录公开的 low/high/max | 提供 low、high、max | 分别测质量与成本。 |
| Agent 接口 | 早期 Agent 场景 | 原生 Responses API、Codex 指引 | 记录工具调用和停止条件。 |
| 八题实测 | 预览版 24.8% | 同文 V4-Pro-0813 为 61/80 | 只作同一测试内的方向性比较。 |
| 已知取舍 | 早期反馈按任务波动 | MindStudio 看到前端/规划强,SVG/润色和过度工程弱 | 保留人工复核。 |
MindStudio 的八项任务包括电梯逻辑、3D 镜头、折叠桌动画、SVG、游戏、排列数学、长链路 Agent 和双时区手表。任务具体,但完整提示词、模型参数、重复次数和工具配置没有公开,因此不能推导出普遍提升。可在 DeepSeek V4 Pro 测评集合 查看证据边界。
为什么要记录这个数字
Artificial Analysis 当前快照的每指数任务 0.67 美元只是规划参考,不是账单。它对应 2026 年 9 月 20 日看到的 max 档 V4 Pro 0813,当前显示 Index 36、排名 7/113。旧研究笔记曾记录 Index 53、排名 3/107;页面和样本集合已经变化,不能拼成趋势线。
因此应比较“完成一个合格任务的成本”,而不是只看排名。长输出、重试和人工修改都会抬高实际成本。可以结合 Agent 推理指南拆分模型能力与工作流质量。
仍然未知的风险
测试夹具不完整: XSCT 记录的规划结果(基础 98.0、高级 92.6)和澄清结果(68.5)都由 LLM 评审,系统提示、工具、温度和重试规则未公开。
快照会变化: 不要把当前 Index 36 与旧笔记的 Index 53 混用。
任务成本不稳定: 高低峰、缓存命中、推理档位、长输出和重试都会改变账单。
行为取舍: MindStudio 观察到简单任务上的过度思考和过度工程,大上下文不代表会选择正确上下文。
模态限制: 当前官方 API 不支持 vision。
可用性差异: API、App Expert Mode 和第三方选择器不是同一项承诺。
社区反馈:有用的分歧
Reddit 长上下文讨论的原帖已被删除,以下是仍可见的评论,不是代表性调查:
DeciusCurusProbinus(约 2026 年 6 月)说:“Pretty much, if you are not a vibe coder.” 没有可复现任务或推理档位。SiteSpecialist6295(约 2026 年 6 月)称 Pro 是“massive improvement over other DS models for agentic coding”,同时提醒模糊截图提示可能带来后续或安全问题;原帖正文已删除。The_Meme_Economy(约 2026 年 8 月)报告约 90% 的应用和美元级成本,并把多数执行交给 Flash、把 Pro 留给规划和复核;这是个人路由选择,不是价格依据。burntoutdev8291(约 2026 年 8 月)认为 Flash 适合架构/计划,但 Pro “very slow”;硬件、档位和提示词未知。
它们共同指向一个可执行做法:给 Pro 明确计划、验收条件和可回滚空间;常规执行可交给更快的模型,但要通过同一验收。也可以参考 AI 浏览器对比,区分模型选择和产品选择。
谁适合先试?
| 如果你的工作是 | 第一步 | 原因 |
|---|---|---|
| 多文件编码,有测试和停止条件 | high 档小规模试用,记录工具调用 | 规划和长链路是最有力的适用场景。 |
| 大型代码库或文档 | 先测试受控片段,不要一次塞入全部语料 | 100 万上下文不保证检索正确或成本低。 |
| 价格敏感的常规生成 | 先比较 Flash 或其他便宜路由 | 高峰输出和长回答可能抵消 token 价格。 |
| 视觉调试或截图理解 | 不要默认 Pro 可以完成 | 当前 API 表格不支持 vision。 |
| 安全敏感的改动 | 要求测试、diff 复核和人工签字 | 公开证据不能证明漏洞已被关闭。 |
| 浏览器工作 | 先读 Agent 浏览器指南并核对权限 | 浏览器提供工具和权限,不提供认证。 |
下一步:只测一个可回滚任务
选择一个小型多文件改动、结构化文档抽取,或“先规划、再单独执行”的任务。记录模型 ID、推理档位、上下文大小、工具权限、输入/输出/思考 token、延迟、重试、工具调用和人工修正,并用当前模型跑同一夹具。只有当每个合格结果的成本下降或人工干预明显减少时,才扩大使用。
如果工作发生在浏览器中,可以阅读 浏览器自动化指南和 Tabbit Browser 介绍。本文没有验证 V4 Pro 账号或任务,因此上线前请先核对实时选择器。
需要起步样例时,可以查看模型的 Prompt 库,再参考 最佳 AI 浏览器指南。这些页面用于发现方向,不代表某个提示词或客户端一定适合你的账号。
结论
DeepSeek V4 Pro 值得用于长链路规划、Agent 编码和大上下文工作的受控试点。GA 后的推理档位和 API 让它比预览版更容易测,但它不是普遍赢家:分时价格、输出量、过度工程、延迟、不支持视觉,以及不同路由的可用性都必须纳入决策。
固定模型和档位,选择可回滚任务并设置独立验收。让每个合格结果的成本和人工干预,决定 Pro 是否长期留在执行模型旁边。
来源
常见问题
DeepSeek V4 Pro 是什么?
DeepSeek V4 Pro 是面向推理和 Agent 工作的通用模型。当前 API 目录将其标为 deepseek-v4-pro,版本为 DeepSeek-V4-Pro-0813,上下文窗口 100 万 token,最大输出 38.4 万 token。
DeepSeek V4 Pro 0813 有什么变化?
2026 年 8 月 13 日 GA 发布增加了 low、high、max 推理档位、Responses API 和 Codex 优化指引。独立八题测试也显示它高于预览版,但完整测试配置没有公开。
DeepSeek V4 Pro 如何收费?
2026 年 9 月 20 日核对的官方表格显示,缓存命中输入为每百万 token 0.022/0.044 美元,缓存未命中为 0.66/1.32 美元,输出为 1.98/3.96 美元,依次对应低峰/高峰。价格和时间窗会变化。
在哪里可以使用 DeepSeek V4 Pro?
DeepSeek 发布说明列出 API、OpenAI 兼容与 Anthropic 兼容接口,以及网页和 App 的 Expert Mode。实际可用性仍取决于账号、地区、额度和客户端。
DeepSeek V4 Pro 支持视觉吗?
当前官方 API 表格标注不支持 vision。涉及截图或图片时,应使用明确支持视觉的路由或模型。
切换前如何测试 DeepSeek V4 Pro?
固定模型 ID 和推理档位,选择一个可回滚任务,记录 token、工具调用、延迟、重试和人工修正,再与当前模型比较每个合格结果的成本。