Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

Doubao Seed 2.0 Lite · 媒体来源 · 独立测量

APIYI:Seed 2.0 Lite 与 Pro 基准表、视觉档位和生产场景

APIYI 表格比较 Lite/Pro 的网关基准与视觉档位;路由、计费和测试协议属于第三方入口,不能等同原生 Ark。

待验证:本次未能重新核实原文。下方历史数字不代表已核实的当前结果。

媒体来源独立测量编辑日期 2026-09-20

测试条件速查

条件
APIYI 网关的 Lite/Pro 基准表与视觉档位配置;路由和计费属于第三方入口。
样本/日期
表格样本与协议按原文披露;本轮重开 2026-09-20,当前价格需重查。

关键数据与适用场景

一句话结论

APIYI 的对照表显示 Lite 在 AIME、知识、视觉、视频和代码任务上接近 Pro,并公开 low/high/xhigh 视觉档位;这些是 provider 页面整理的 benchmark 数据,需在同一 API 上复核。

适用场景

  • 适合的任务:文档/收据/合同抽取、图表分析、视频理解、搜索推荐、工具调用和高 QPS 生产路由。

  • 不适合的任务:把 provider 页面基准当成独立重跑,或在财务/高风险任务中省略人工抽查。

  • 适用的模型版本:APIYI 的 seed-2-0-lite-260228;页面同时列 Seed2.0 Pro 和 Seed1.8 作对照。

  • 适用的客户端、Agent 或 API:APIYI OpenAI-compatible endpoint https://api.apiyi.com/v1;不是火山方舟直连。

  • 推荐的推理档位和参数:视觉输入可按 low/high/xhigh 选档;页面未公开完整 temperature、reasoning 和工具参数。

测试环境

  • 测试方:APIYI 的模型介绍和 benchmark 汇总页。

  • 对照模型:Seed 2.0 Lite、Seed 2.0 Pro、Seed 1.8。

  • 测试任务:AIME 2025、MMLU-Pro、SWE-Bench Verified、LiveCodeBench v6、MathVision、MathVista、VideoMME、COLLIE。

  • 完整输入/配置:页面未公开原始 prompt、样本量、采样次数、工具和评测脚本。

输入/配置

  • 输入模态:文本、图片、视频;输出类型为文本。

  • 视觉档位:low 适合简单识别/快速分类,high 为标准文档/图表分析默认档,xhigh 面向密集文字、复杂图表和细节丰富场景。

  • API:OpenAI-compatible;页面列出的模型名为 seed-2-0-lite-260228。

  • 知识截止:页面列出 2024-01;该字段应按当前 provider 实测/文档复核。

结果数据

APIYI 页面表格直接列出的数值:

BenchmarkSeed 2.0 LiteSeed 2.0 ProSeed 1.8
AIME 202593.096.0-
MMLU-Pro87.787.0-
SWE-Bench Verified73.5%76.5%-
LiveCodeBench v681.784.0-
MathVision86.4-81.3
MathVista89.0--
VideoMME87.7--
COLLIE94.0--

页面据此将 Lite 定位为约为 Pro 五分之一成本、适合日常生产任务和高并发覆盖,并将 MMLU-Pro 视为 Lite 高于 Pro 的知识任务例子。

结论

这份资料支持 Lite 在结构化知识、视觉理解和高吞吐多模态场景中作为 Pro 的成本替代候选;SWE-Bench 和 LiveCodeBench 仍低于 Pro,复杂软件工程应保留升级路径。视觉档位可直接转成成本/质量 A/B 变量。

局限

  • APIYI 是第三方 provider,页面没有提供 benchmark 原始输入、评测代码或独立复核证明。

  • “约五分之一成本”、知识截止、模型名和 endpoint 都是 provider 页面口径,不等同于方舟当前价格或快照。

  • 表格中的 benchmark 可能来自官方 Model Card;不能将其标记为 APIYI 独立受控测试。

复现步骤

  1. 在 APIYI 固定 seed-2-0-lite-260228、视觉档位、temperature、max output 和请求模式。

  2. 对 AIME/MMLU/代码/视觉/视频任务保存原始输入和输出,并与 Pro 使用相同 prompt、工具和超时。

  3. 分别统计准确率、字段/代码测试、视频事件识别、token、延迟、错误和重试成本。

  4. 在 high 与 xhigh 视觉档位之间做同样输入的 A/B,判断质量提升是否抵消成本。

来源摘录或观察(仅做合规短引)

  • 页面把 Lite 的视觉输入拆成 low/high/xhigh 三档,而不是只给一个“视觉能力”标签。

  • 页面同时列出 Lite 与 Pro 的代码和知识分数,适合作为路由假设,但不应替代独立复测。

能支持的判断

  • 可用于比较 APIYI 网关记录的 Lite/Pro 基准表与视觉档位配置。

不能支持的判断

  • 数据来自第三方网关,路由、计费和视觉配置不等于火山方舟原生服务。
  • 表格的测试协议和当前价格需重新核验,不能作为跨模型定论。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

APIYI 文档中心 · APIYI · 原文发布日期 2026-02-14 · 本站编辑日期 2026-09-20

打开原始来源

Doubao Seed 2.0 Lite

在 Tabbit 中比较 Doubao Seed 2.0 Lite

下载 Tabbit 客户端后检查模型可用性

相关评测

ByteDance 官方发布:Seed2.0 系列多模态与长程 Agent 证据ByteDance 发布材料将 Seed 2.0 Lite 定位为多模态、长程 Agent,并给出发布时评测主张;这些不是独立生产率。OpenRouter:Seed 2.0 Lite 实时延迟、吞吐与 Provider 活动观察OpenRouter 快照展示 Lite 的 provider 活跃度、延迟和吞吐观察;路由与流量动态,不能当作质量或 SLA 基准。Reddit:Seed 2.0 Lite 在“锈针污染干草堆”检索测试中的表现Reddit 作者用自建“锈针污染干草堆”任务记录 Lite 的检索结果;这是单一社区基准,不能形成标准排名。Seed 2.0 Lite:Puter.js/OpenAI 兼容调用与多模态配置按“Seed 2.0 Lite:Puter.js/OpenAI 兼容调用与多模态配置”的任务特定指南执行;前置条件、步骤、验收、修正和来源边界均已写明。