Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

DeepSeek V4 Flash · 媒体来源 · 客户案例

Lightning AI 的价格性能与架构观察

Lightning AI 文章给出 2026-04-24 口径:Flash 约 60+ tokens/s、SWE-bench Verified 79.0%,并将 V4 的 1M 上下文与工具间持久推理作为架构背景。

媒体来源客户案例编辑日期 2026-09-20

测试条件速查

测试/来源条件
Lightning AI 内部使用;Pro/Flash 与 2026-04-24 价格口径分开
模型版本
DeepSeek V4 Flash;不与 V4 Pro、0424、0731 或其他推理档位混并,除非来源明确如此
采集边界
既有来源笔记采集于 2026-08-17/18;动态事实待刷新

关键数据与适用场景

背景

DeepSeek 发布两款开源模型 V4-Pro 和 V4-Flash,已在全球生产环境运行(包括 Lightning AI 内部)。Lightning AI 优化工程师的初评:"编码是我主要用途——它很好。"

模型定位

  • DeepSeek-V4-Pro:1.6T 总参数、49B 激活,面向深度推理与 agentic 编码

  • DeepSeek-V4-Flash:284B 总参数、13B 激活,面向速度与高吞吐流水线

  • 两者均标准支持 1M token 上下文窗口

相比 V3.2 的改进

维度V3.2V4
上下文窗口128K1M(标准)
KV 缓存baselineV3.2 的 10%(CSA + HCA 混合压缩稀疏注意力架构)
推理 FLOPsbaselineV3.2 的 27%(1M tokens 下)
工具调用间推理stateless,每次重新开始persistent,保留完整思维链,20 步流水线不丢上下文
SWE-bench Verified~69%Pro 80.6% / Flash 79.0%

关键对比矩阵(价格截至 2026-04-24)

DeepSeek V4-ProDeepSeek V4-FlashDeepSeek V3.2Claude Opus 4.6
上下文1M1M128K1M
输入价格/1M$1.74(cache miss)/ $0.145(hit)$0.14(miss)/ $0.028(hit)$0.28 / $0.028$5.00 / $0.50
输出价格/1M$3.48$0.28$0.42$25.00
开源✅ MIT✅ MIT✅ MIT❌
速度(约)~33 tokens/s60+ tokens/s~35 tokens/s中等
SWE-bench Verified80.6%79.0%~69%80.8%
LiveCodeBench93.5%91.6%—88.8%
Codeforces32063052—未报告
Terminal Bench 2.067.9%56.9%—65.4%
GPQA Diamond90.1%88.1%—91.3%

结论要点

  • V4-Pro 在 SWE-bench Verified 上 80.6%,距离 Claude Opus 4.6 仅 0.2 个点,而输出价格是后者的约 1/7($3.48 vs $25)

  • V4 的混合压缩注意力(CSA/HCA)把 1M 上下文的经济可行性做出来了

  • 持久化的跨工具调用推理是 V4 在 Agent 场景的关键升级

  • 定价与基准分数来源:DeepSeek V4 技术报告(Max reasoning 模式)与 Anthropic 定价页

能支持的判断

  • 支持比较文章当时的价格性能叙事与 V3.2/V4 架构差异。

不能支持的判断

  • 不支持把 Lightning 内部使用、旧价格或 Pro/Flash 表格当作当前 API 或独立复测。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

Lightning AI 博客 · Frances Fedoriska · 原文发布日期 2026-04-27 · 本站编辑日期 2026-09-20

打开原始来源

DeepSeek V4 Flash

在 Tabbit 中比较 DeepSeek V4 Flash

下载 Tabbit 客户端后检查模型可用性

模型深度阅读

定价 · 简体中文

DeepSeek V4 Flash 价格:2026 年实际要花多少钱

DeepSeek V4 Flash 在 V4.1 迁移后更换了计费口径。本文解释缓存命中、峰谷时段和可复算的任务成本。

相关评测

DeepSeek V4 Flash 0731:基准、定价与速度(BenchLM)BenchLM 的 0731 快照列出 1M 上下文、Agentic 51.9、Coding 48.5、Knowledge 61.1,并把多项分数回指官方报告。DeepSeek V4 Flash 第三方聚合平台数据(Command Code / flaq.ai / OpenRouter / benchlm 补充)Command Code、flaq、OpenRouter 和 BenchLM 聚合模型 ID、价格和能力字段,采集窗口可能不同。DeepSeek V4-Flash 正式版来了!AI 开发者实测:价格"很香" Agent 能力直追顶级模型东方财富转述开发者案例:Hermes + Flash 约 40 秒完成任务,GPT + Codex 约 1 分 47 秒;另一任务约 51 万 tokens、0.53 元。什么是 DeepSeek 斩杀线?DeepSeek-V4-Flash 第一手测评来了!程序员小灰用价格—能力坐标解释 Flash 的“斩杀线”,属于个人解读与资料复述。配置思考档位并正确续接工具调用把 low/high/max、工具结果和 reasoning_content 的回传顺序整理成可复查的接入步骤。用官方配置把 DeepSeek 接入 Codex先备份本地配置,再用官方脚本或最小 provider 字段接入 Responses API,并用可回滚任务验证。用 DSH 分层委派并汇总专论来源公开了完整起始提示词:一级研究、二级反驳与编辑、最终综合,目标是单一有引用的 Markdown 产物。用 CRISPE 框架组织 DeepSeek 任务把角色、请求、背景、约束、风格和多方案尝试写成明确的任务合同。