MiMo-V2.6-Pro · 媒体来源 · 独立测量
Artificial Analysis 在 Xiaomi provider、推理版本和默认 10,000 输入 token 的生产型工作负载下测得 MiMo-V2.6-Pro 的 Intelligence Index 为 46.324(页面显示 46)、输出速度 129.75 tokens/s、首个答案 token 延迟 17.58 秒、端到端输出 500 token 为 21.44 秒,价格处于低成本区间,但推理等待时间占首 token 延迟的大部分。
Artificial Analysis 在 Xiaomi provider、推理版本和默认 10,000 输入 token 的生产型工作负载下测得 MiMo-V2.6-Pro 的 Intelligence Index 为 46.324(页面显示 46)、输出速度 129.75 tokens/s、首个答案 token 延迟 17.58 秒、端到端输出 500 token 为 21.44 秒,价格处于低成本区间,但推理等待时间占首 token 延迟的大部分。
适合的任务:需要较强综合推理能力、长上下文、多模态输入或 Agent 工作流,同时重视 API 单价和输出速度的任务;AA 页面给出的输入模态包括文本、图像、语音和视频,上下文窗口为 1M tokens。
不适合的任务:对首字响应极敏感的交互式短问答;需要按不同 provider、不同推理档位或不同随机种子做严格横向复验的任务;本页只有 Xiaomi 一个 provider,无法代表其他部署。
适用的模型版本:MiMo-V2.6-Pro 的 reasoning 版本。不能把本页结果外推到 MiMo-V2.6-Pro-RL、MiMo-V2.6-Pro-Ultraspeed、MiMo-V2.6-Flash 或其他非 reasoning 变体。
适用的客户端、Agent 或 API:Artificial Analysis 的独立基准环境,以及页面列出的 Xiaomi API provider;页面没有公开可直接复制的完整请求 payload、工具 schema 或评测 harness。
推荐的推理档位和参数:本来源没有公开可选推理档位、temperature、top-p、随机种子或完整 API 参数;复测应固定 reasoning 版本、Xiaomi provider、10,000 输入 token 工作负载,并逐项记录未知参数。
使用 Artificial Analysis 模型页核对 MiMo-V2.6-Pro 的模型身份、reasoning 标记和 Xiaomi provider 关联;不要混用 Pro、Flash、RL 或 Ultraspeed 的结果。
以 Artificial Analysis Intelligence Index v4.3.2 作为综合智能测量。页面说明该指数包含 10 个评测:AA-Briefcase v1.1、GDPval-AA v2.1、AutomationBench-AA、Terminal-Bench 4.0、SciCode、Humanity's Last Exam、GDP.pdf、CritPt、AA-Omniscience、AA-LCR v1.1。
读取模型页内的结构化 Dataset 数据,记录指数、输出 token 使用量、每任务成本、总评测成本和速度;其中指数页面的 measurementTechnique 明确写为 Artificial Analysis 在专用硬件上独立运行。
在 Provider Benchmark 页使用默认的 10,000 输入 token 工作负载。页面的价格说明采用 cache-input-output 为 7:2:1 的 blended price;速度为 output tokens/s;延迟以首个答案 token 和端到端输出 500 tokens 计量。
对首个答案 token 延迟按页面结构化数据拆分:推理时间 + 输入处理时间 = 首个答案 token 时间。对端到端时间按输入处理 + 推理 + 输出 500 tokens 时间核对。
与其他模型比较时,必须保留页面显示的推理标签(例如 max、high、xhigh)和各自 provider;不能把页面排名当作同一推理档位下的因果结论。
| 字段 | Artificial Analysis 页面值 | 复核说明 |
|---|---|---|
| 模型 | MiMo-V2.6-Pro | 模型页标题与结构化数据中的 label 均一致 |
| 创建者 | Xiaomi | 页面显示 Xiaomi;页面将其标为 open weights model |
| reasoning | Yes | 页面注明当前页面显示该模型的 reasoning version |
| Provider | Xiaomi | Provider 页写明仅有 1 个 provider,即 Xiaomi |
| 评测硬件口径 | Artificial Analysis 专用硬件 | 模型页内 Dataset 的 measurementTechnique 原文为独立测试 |
| Provider 工作负载 | 10,000 输入 tokens | Provider 页说明默认性能基准工作负载更新为 10k input tokens |
| 指数版本 | Artificial Analysis Intelligence Index v4.3.2 | 页面明确列出版本和 10 个组成评测 |
| 页面排名 | Intelligence #1 / 114 | 这是模型页摘要中的模型类排名,不等于所有 656 个模型的全球排名 |
| 指标 | 原始数值 | 页面显示/计算值 | 条件与边界 |
|---|---|---|---|
| Intelligence Index | 46.3242065310383 | 46 | v4.3.2;10 个评测组成;不是小米官方自报分数 |
| 输出速度 | 129.748797446312 tokens/s | 129.7 / 130 tokens/s | Xiaomi provider;页面定义为 output tokens per second |
| 每个指数任务的推理 token | 37,519.68181980028 | 页面未完整展示 | 结构化 Dataset 的 reasoning 字段;任务集内加权平均口径 |
| 每个指数任务的 answer token | 26,756.018691867608 | 页面未完整展示 | 结构化 Dataset 的 answer 字段 |
| 每个指数任务总输出 token | 64,275.70051166789 | 页面摘要约 140M 为整个指数评测累计量 | reasoning + answer;页面未提供每个子评测的拆分样本量 |
| 每个 Intelligence Index 任务成本 | 0.13322318937213493 USD | $0.13 | 页面定义为 weighted average cost per Intelligence Index task |
| 运行完整 Intelligence Index 总成本 | 206.65529999999998 USD | $206.66 | 结构化成本分项相加;不是用户单次请求成本 |
| 输入价格 | 0.435 USD / 1M tokens | $0.435 | Xiaomi provider;非缓存输入 |
| 输出价格 | 0.87 USD / 1M tokens | $0.87 | Xiaomi provider |
| Cache hit 价格 | 0.0036 USD / 1M tokens | 页面显示 <0.01 | Xiaomi provider |
| Cache discount | 99.17241379310345% | 页面摘要约 99% | 由 1 - cache hit price / input price 计算 |
| Blended price | 0.17652000000000001 USD / 1M tokens | $0.18 | Provider 页的 7:2:1 cache-input-output 混合口径 |
Artificial Analysis 的延迟数据明确区分推理时间和输入处理时间。其模型页 Dataset 给出的 MiMo-V2.6-Pro 数据如下:
| 指标 | 原始数值(秒) | 页面显示/计算值 | 定义 |
|---|---|---|---|
| 推理时间 | 15.414401053139381 | 15.41 | reasoning model 在首个答案 token 前的 thinking 时间 |
| 输入处理时间 | 2.1672836154999802 | 2.17 | API 请求后的输入处理时间;Provider 表中对应 Median First Chunk |
| 首个答案 token | 17.58168466863936 | 17.58 | 15.414401053139381 + 2.1672836154999802;页面以“Time to First Answer Token”突出 |
| 输出 500 tokens 的输出时间 | 3.8536002632848452 | 3.85 | 500 tokens 按测得输出速度计算的输出阶段 |
| 端到端响应时间 | 21.435284931924205 | 21.44 | 输入处理 + 推理 + 输出 500 tokens |
因此,在该测量口径下,推理等待时间约占首个答案 token 延迟的 15.4144 / 17.5817 ≈ 87.7%;这是对页面公开分项的计算,不代表其他请求长度或 provider 的延迟。
上下文窗口:1,000,000 tokens。
总参数:页面显示约 1.0T;结构化模型大小 Dataset 给出被动参数约 978B。
激活参数:42B。
输入:文本、图像、语音、视频。
输出:文本。
许可证:MIT。
这是 Artificial Analysis 的独立基准结果,不是 Xiaomi 官方发布基准,也不是本地复测;不能据此声称在所有 API、地区、网络或负载下都能达到同样速度。
页面结构化数据说明测量在 Artificial Analysis 专用硬件上独立运行,但没有公开完整硬件型号、请求 payload、并发度、网络路径、随机种子、temperature、top-p、超时策略或失败样本,因此复现只能做到指标与工作负载层面的近似复核。
Intelligence Index 的页面正文列出 10 个组成评测,但没有为 MiMo-V2.6-Pro 提供每项得分、各项样本量、置信区间或逐题日志;46.324 适合作为聚合比较信号,不应拆解为单项能力结论。
Provider 页只有 Xiaomi 一个 provider。$0.13 每任务、$0.18 blended price 和 17.58 秒首答延迟均不能外推到未列出的 provider。
页面价格是每百万 token 的公开计价;完整 Intelligence Index 的 $206.66 是 Artificial Analysis 评测支出,不能当作普通用户一次会话的价格。
模型页的 #1 / 114 与图表中的 “28 of 656 models” 属于不同筛选/展示上下文;二者不能混写成同一排名。
Artificial Analysis 的 X 账号 https://x.com/ArtificialAnlys 已通过 Tabbit 打开,但时间线返回“似乎你的连接已断开。我们将继续重试”,没有看到任何与 MiMo-V2.6-Pro 直接相关的帖子,故不引用标题、摘要或转述补写数据。
模型页 Dataset 对测量方法的公开描述:Independent test run by Artificial Analysis on dedicated hardware.
Provider 页提示:默认性能基准工作负载已更新为 10k input tokens。
Provider 页的结构化数据同时给出 Xiaomi 的 129.74879744631201 output tokens/s、15.414401053139381 秒 reasoning time 和 2.1672836154999802 秒 input processing time;本篇将这些原始字段保留到足够精度,并把四舍五入值单独列为页面展示值。
本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。
需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。
Artificial Analysis · Artificial Analysis · 原文发布日期 2026-09-22 · 本站编辑日期 2026-09-22
打开原始来源MiMo-V2.6-Pro
下载 Tabbit 客户端后检查模型可用性