在 OpenRouter 单一上游 Provider 的观测窗口内,Turbo 页面显示约 2.24 秒 P50 延迟、48 tok/s P50 吞吐和 100% 三日 uptime;这些是网关观测值,不是固定 SLA 或模型能力 benchmark。
适合的任务:评估 Turbo 的低延迟/高吞吐路由、OpenAI 兼容接入、reasoning token 记录和 provider 健康监控。
不适合的任务:将一个网关的 P50 延迟外推为所有地区或方舟直连延迟,或把 uptime 当作业务可用性保证。
适用的模型版本:OpenRouter slug bytedance-seed/seed-2-1-turbo;上游模型快照未在页面公开。
适用的客户端、Agent 或 API:OpenRouter Chat Completions/Responses/Anthropic 兼容接口;页面说明当前只有一个上游 Provider。
推荐的推理档位和参数:按网关页面使用 reasoning 参数,并保存返回的 reasoning_details;具体 effort 和 max_tokens 需按任务固定。
观测方:OpenRouter 公开模型页。
Provider:页面显示一个上游 Provider,OpenRouter 直接转发,不做多 Provider 路由选择。
统计窗口:页面显示近 3 天 uptime,当前窗口为 Aug 15 22:00 至 Aug 18 22:00;延迟/吞吐为页面 P50 观测。
请求任务:页面未公开用于延迟统计的 prompt 集、请求分布、地区或并发设置。
模型 slug:bytedance-seed/seed-2-1-turbo。
上下文与输出:页面显示 262,144 token context window 和最大 262,144 token output;这与官方方舟页面的 256K 输入口径存在展示差异,使用前应以实际端点响应核实。
价格:页面显示加权平均输入 $0.50/百万 token、输出 $2.50/百万 token;缓存和折扣可能使实际支付低于标价。
Reasoning:页面说明支持 reasoning 参数和 reasoning_details,续写对话时应保留完整 reasoning details;这不是火山方舟原生字段保证。
P50 延迟:2.24 秒。
P50 吞吐:48 tok/s。
Uptime(近 3 天):100.00%。
Availability(近 3 天):99.58%;页面还显示近 24 小时为 99.35%。
加权平均价格:输入 $0.50/百万 token,输出 $2.50/百万 token。
流量观察:页面统计 prompt 15.3M、reasoning 3.77M、completion 1.27M token;这是 OpenRouter 页面活动量,不是单任务质量分数。
OpenRouter 数据支持把 Turbo 纳入低延迟、成本敏感的 Agent 路由试验,并提醒评测中要记录 reasoning token 和网关健康状态。它不能证明 Turbo 在编码或视觉任务上优于其他模型,也不能替代方舟直连的延迟、价格和数据合规核验。
统计是 provider/gateway 观测,页面没有公开 prompt、token 长度分布、并发、地域、P95/P99 或完整采样方法。
单一 Provider 的健康度不能代表方舟、其他聚合器或所有用户的体验。
页面数值会滚动更新;本条目只记录 2026-08-18 采集时窗口。
OpenRouter 的 262,144 context/max output 展示与火山方舟官方页面的 256K 输入口径可能是单位或接口层差异,不能未经核实合并。
用同一 OpenRouter slug、固定 prompt token 桶、并发和地区,分别记录 TTFT、总延迟、吞吐、reasoning token 和错误。
对比火山方舟直连和至少一个参考模型,保持输入、工具、stream、max_tokens 和 timeout 一致。
分别计算 P50/P95/P99、可用率、失败重试和单任务成本,不以页面 P50 代替尾延迟。
将网关统计与任务完成率、独立测试和人工 review 结果关联,定期保存采集时间窗口。
页面强调当前请求直接转发给一个 Provider,未进行多 Provider 选择。
页面说明继续对话时应保留完整 reasoning_details,这是可复用的调用配置注意事项。
Doubao Seed 2.1 Turbo