在预算敏感的 Agent 路由中使用 doubao-seed-2.1-turbo,应明确区分在线与 Batch 价格,并把 256K 输入上限和实际模型快照写入评测配置。
适合的任务:高吞吐、低延迟 Agent、批量编码/抽取、Pro/Turbo 成本 A/B 和预算测算。
不适合的任务:把价格表当作完整 API schema,或用 Batch 单价承诺在线延迟。
适用的模型版本:在线模型 doubao-seed-2.1-turbo;不可与 doubao-seed-2.1-pro 混用。
适用的客户端、Agent 或 API:火山方舟在线调用与 Batch;endpoint、鉴权和地区可用性需按当前控制台确认。
推荐的推理档位和参数:未公开;将思考开关、最大输出、temperature、工具和重试策略作为必填记录项。
这是将官方页面归一化为路由配置的模板;字段名便于内部使用,不是官方接口完整 schema:
provider: volcengine-ark
model: doubao-seed-2.1-turbo
mode: online # online 或 batch,不能用同一价格预算
max_input_context: 256k
pricing:
input_yuan_per_million_tokens: 3.00
cached_input_yuan_per_million_tokens: 0.60
output_yuan_per_million_tokens: 15.00
batch_pricing:
input_yuan_per_million_tokens: 1.50
cached_input_yuan_per_million_tokens: 0.60
output_yuan_per_million_tokens: 7.50
record_for_each_run:
endpoint_snapshot: required
reasoning_mode: required
prompt_tokens: required
completion_tokens: required
retries: required在方舟控制台核实模型 ID、地域、可购买规格和 endpoint;官方页面说明订单结果是最终规格/费用依据。
在线任务记录输入、缓存命中、输出、延迟和重试;Batch 任务单独记录排队和完成时间。
长上下文任务检查是否超过页面列出的 256K 输入区间,并记录分块策略。
价格或模型快照更新后,保留采集日期并重跑同一任务集。
官方页面列出 doubao-seed-2.1-turbo 在线输入长度 [0,256]K,输入 3.00 元/百万 token、缓存命中 0.60 元/百万 token、输出 15.00 元/百万 token。
同页列出 Turbo Batch 输入 1.50 元/百万 token、缓存命中 0.60 元/百万 token、输出 7.50 元/百万 token。
页面同时列出 Pro 的更高价格;配置中必须以模型 ID 选择对应价格,不能按“Seed2.1”家族名模糊计费。
页面最后更新时间为 2026-08-17 13:54:22。
页面没有提供完整请求字段、工具调用示例、思考档位、响应格式或数据处理条款;未知字段明确为未公开/无法核实。
256K 是页面显示的输入长度上限,不保证每个网关或 Agent harness 的可用上下文相同。
单价不包含路由、重试、预处理、人工审查和失败任务成本;Turbo 是否更便宜要按完成任务计算。
官方表格把在线与 Batch 分列,这两种执行模式必须在内部账本中分开。
页面提醒实际可购买规格和费用以订单结果为准。
Doubao Seed 2.1 Turbo