用 doubao-seed-2.1-pro 作为线上模型 ID,并把 256K 输入上限、在线/批量价格和缓存命中价格写进路由配置,便于在固定预算下复现 Agent 评测。
适合的任务:火山方舟上的 API 路由、成本预算、Pro/Turbo A/B 评测和批处理规划。
不适合的任务:把下列归一化配置块直接当成完整 SDK 请求;鉴权、地域、端点、工具参数和响应字段仍需按当前 API 文档配置。
适用的模型版本:在线模型 doubao-seed-2.1-pro;页面另列 doubao-seed-2.1-turbo,不要混用模型 ID。
适用的客户端、Agent 或 API:火山方舟在线调用和 Batch;具体 endpoint/鉴权未在本页完整公开。
推荐的推理档位和参数:未公开;评测时固定并记录实际请求中的思考开关、最大输出、温度等字段。
下面是把官方价格表整理成路由配置的最小模板。字段名是知识库归一化字段,不是官方接口 schema:
provider: volcengine-ark
model: doubao-seed-2.1-pro
mode: online
max_input_context: 256k
pricing:
input_yuan_per_million_tokens: 6.00
cached_input_yuan_per_million_tokens: 1.20
output_yuan_per_million_tokens: 30.00
batch_pricing:
input_yuan_per_million_tokens: 3.00
cached_input_yuan_per_million_tokens: 1.20
output_yuan_per_million_tokens: 15.00
evaluation_record:
model_snapshot: record-the-current-endpoint-snapshot
reasoning_mode: record-from-request
tools: record-tool-list
prompt_tokens: record
completion_tokens: record在方舟控制台确认实际可购买的模型 ID、地域和 endpoint;官方页面说明最终规格和费用以订单结果为准。
在线评测记录输入、缓存命中、输出 token 和请求模式;长上下文任务单独记录是否超过 256K 输入上限。
大批量、可延迟任务使用 Batch 价格表单独核算,不把 Batch 价格当成在线延迟服务价格。
每次模型或价格更新时保存页面采集日期和实际响应中的模型快照,重新运行同一测试集。
官方页面列出 doubao-seed-2.1-pro 在线输入上限为 [0,256]K,在线输入 6.00 元/百万 token、缓存命中 1.20 元/百万 token、输出 30.00 元/百万 token。
同页列出 Pro Batch 输入 3.00 元/百万 token、缓存命中 1.20 元/百万 token、输出 15.00 元/百万 token。
同页列出 Turbo 作为另一模型:在线 3.00/0.60/15.00 元,Batch 1.50/0.60/7.50 元(输入/缓存命中/输出);这些数字不应套到 Pro。
页面标注最后更新时间为 2026-08-17 13:54:22,价格和可购买规格可能变化。
该页面是价格与模型列表页,不是完整 API 参数说明;工具调用、响应格式、思考档位、音频输入和区域可用性不能从本页推断。
“256K”是页面显示的输入长度区间,不等于任何 Agent harness 都能无损利用;实际还受系统提示词、工具结果和输出预算影响。
价格未包含业务侧重试、路由、预处理、缓存策略和人工审查成本;总成本应按完整任务闭环核算。
页面强调实际可购买规格和费用以订单结果为准。
页面将在线与 Batch 分开列价;本配置也必须保留这两个执行模式。
Doubao Seed 2.1 Pro