Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

MiMo-V2.6-Pro · 媒体来源 · 独立测量

Artificial Analysis:MiMo-V2.6-Pro 的智能指数、速度、价格与延迟

Artificial Analysis 在 Xiaomi provider、推理版本和默认 10,000 输入 token 的生产型工作负载下测得 MiMo-V2.6-Pro 的 Intelligence Index 为 46.324(页面显示 46)、输出速度 129.75 tokens/s、首个答案 token 延迟 17.58 秒、端到端输出 500 token 为 21.44 秒,价格处于低成本区间,但推理等待时间占首 token 延迟的大部分。

媒体来源独立测量编辑日期 2026-09-22

测试条件速查

来源具体观察
Artificial Analysis 在 Xiaomi provider、推理版本和默认 10,000 输入 token 的生产型工作负载下测得 MiMo-V2.6-Pro 的 Intelligence Index 为 46.324(页面显示 46)、输出速度 129.75 tokens/s、首个答案 token 延迟 17.58 秒、端到端输出 500 token 为 21.44 秒,价格处于低成本区间,但推理等待时间占首 token 延迟的大部分。
已公布条件
对首字响应极敏感的交互式短问答;需要按不同 provider、不同推理档位或不同随机种子做严格横向复验的任务;本页只有 Xiaomi 一个 provider,无法代表其他部署。

关键数据与适用场景

一句话结论

Artificial Analysis 在 Xiaomi provider、推理版本和默认 10,000 输入 token 的生产型工作负载下测得 MiMo-V2.6-Pro 的 Intelligence Index 为 46.324(页面显示 46)、输出速度 129.75 tokens/s、首个答案 token 延迟 17.58 秒、端到端输出 500 token 为 21.44 秒,价格处于低成本区间,但推理等待时间占首 token 延迟的大部分。

适用场景

  • 适合的任务:需要较强综合推理能力、长上下文、多模态输入或 Agent 工作流,同时重视 API 单价和输出速度的任务;AA 页面给出的输入模态包括文本、图像、语音和视频,上下文窗口为 1M tokens。

  • 不适合的任务:对首字响应极敏感的交互式短问答;需要按不同 provider、不同推理档位或不同随机种子做严格横向复验的任务;本页只有 Xiaomi 一个 provider,无法代表其他部署。

  • 适用的模型版本:MiMo-V2.6-Pro 的 reasoning 版本。不能把本页结果外推到 MiMo-V2.6-Pro-RL、MiMo-V2.6-Pro-Ultraspeed、MiMo-V2.6-Flash 或其他非 reasoning 变体。

  • 适用的客户端、Agent 或 API:Artificial Analysis 的独立基准环境,以及页面列出的 Xiaomi API provider;页面没有公开可直接复制的完整请求 payload、工具 schema 或评测 harness。

  • 推荐的推理档位和参数:本来源没有公开可选推理档位、temperature、top-p、随机种子或完整 API 参数;复测应固定 reasoning 版本、Xiaomi provider、10,000 输入 token 工作负载,并逐项记录未知参数。

测试方法/工作流步骤

  1. 使用 Artificial Analysis 模型页核对 MiMo-V2.6-Pro 的模型身份、reasoning 标记和 Xiaomi provider 关联;不要混用 Pro、Flash、RL 或 Ultraspeed 的结果。

  2. 以 Artificial Analysis Intelligence Index v4.3.2 作为综合智能测量。页面说明该指数包含 10 个评测:AA-Briefcase v1.1、GDPval-AA v2.1、AutomationBench-AA、Terminal-Bench 4.0、SciCode、Humanity's Last Exam、GDP.pdf、CritPt、AA-Omniscience、AA-LCR v1.1。

  3. 读取模型页内的结构化 Dataset 数据,记录指数、输出 token 使用量、每任务成本、总评测成本和速度;其中指数页面的 measurementTechnique 明确写为 Artificial Analysis 在专用硬件上独立运行。

  4. 在 Provider Benchmark 页使用默认的 10,000 输入 token 工作负载。页面的价格说明采用 cache-input-output 为 7:2:1 的 blended price;速度为 output tokens/s;延迟以首个答案 token 和端到端输出 500 tokens 计量。

  5. 对首个答案 token 延迟按页面结构化数据拆分:推理时间 + 输入处理时间 = 首个答案 token 时间。对端到端时间按输入处理 + 推理 + 输出 500 tokens 时间核对。

  6. 与其他模型比较时,必须保留页面显示的推理标签(例如 max、high、xhigh)和各自 provider;不能把页面排名当作同一推理档位下的因果结论。

原始证据与数据

1. 模型身份与测量口径

字段Artificial Analysis 页面值复核说明
模型MiMo-V2.6-Pro模型页标题与结构化数据中的 label 均一致
创建者Xiaomi页面显示 Xiaomi;页面将其标为 open weights model
reasoningYes页面注明当前页面显示该模型的 reasoning version
ProviderXiaomiProvider 页写明仅有 1 个 provider,即 Xiaomi
评测硬件口径Artificial Analysis 专用硬件模型页内 Dataset 的 measurementTechnique 原文为独立测试
Provider 工作负载10,000 输入 tokensProvider 页说明默认性能基准工作负载更新为 10k input tokens
指数版本Artificial Analysis Intelligence Index v4.3.2页面明确列出版本和 10 个组成评测
页面排名Intelligence #1 / 114这是模型页摘要中的模型类排名,不等于所有 656 个模型的全球排名

2. Intelligence Index、速度、token 与成本

指标原始数值页面显示/计算值条件与边界
Intelligence Index46.324206531038346v4.3.2;10 个评测组成;不是小米官方自报分数
输出速度129.748797446312 tokens/s129.7 / 130 tokens/sXiaomi provider;页面定义为 output tokens per second
每个指数任务的推理 token37,519.68181980028页面未完整展示结构化 Dataset 的 reasoning 字段;任务集内加权平均口径
每个指数任务的 answer token26,756.018691867608页面未完整展示结构化 Dataset 的 answer 字段
每个指数任务总输出 token64,275.70051166789页面摘要约 140M 为整个指数评测累计量reasoning + answer;页面未提供每个子评测的拆分样本量
每个 Intelligence Index 任务成本0.13322318937213493 USD$0.13页面定义为 weighted average cost per Intelligence Index task
运行完整 Intelligence Index 总成本206.65529999999998 USD$206.66结构化成本分项相加;不是用户单次请求成本
输入价格0.435 USD / 1M tokens$0.435Xiaomi provider;非缓存输入
输出价格0.87 USD / 1M tokens$0.87Xiaomi provider
Cache hit 价格0.0036 USD / 1M tokens页面显示 <0.01Xiaomi provider
Cache discount99.17241379310345%页面摘要约 99%由 1 - cache hit price / input price 计算
Blended price0.17652000000000001 USD / 1M tokens$0.18Provider 页的 7:2:1 cache-input-output 混合口径

3. 延迟与端到端响应

Artificial Analysis 的延迟数据明确区分推理时间和输入处理时间。其模型页 Dataset 给出的 MiMo-V2.6-Pro 数据如下:

指标原始数值(秒)页面显示/计算值定义
推理时间15.41440105313938115.41reasoning model 在首个答案 token 前的 thinking 时间
输入处理时间2.16728361549998022.17API 请求后的输入处理时间;Provider 表中对应 Median First Chunk
首个答案 token17.5816846686393617.5815.414401053139381 + 2.1672836154999802;页面以“Time to First Answer Token”突出
输出 500 tokens 的输出时间3.85360026328484523.85500 tokens 按测得输出速度计算的输出阶段
端到端响应时间21.43528493192420521.44输入处理 + 推理 + 输出 500 tokens

因此,在该测量口径下,推理等待时间约占首个答案 token 延迟的 15.4144 / 17.5817 ≈ 87.7%;这是对页面公开分项的计算,不代表其他请求长度或 provider 的延迟。

4. 模型规格(用于解释测量边界)

  • 上下文窗口:1,000,000 tokens。

  • 总参数:页面显示约 1.0T;结构化模型大小 Dataset 给出被动参数约 978B。

  • 激活参数:42B。

  • 输入:文本、图像、语音、视频。

  • 输出:文本。

  • 许可证:MIT。

适用边界

  • 这是 Artificial Analysis 的独立基准结果,不是 Xiaomi 官方发布基准,也不是本地复测;不能据此声称在所有 API、地区、网络或负载下都能达到同样速度。

  • 页面结构化数据说明测量在 Artificial Analysis 专用硬件上独立运行,但没有公开完整硬件型号、请求 payload、并发度、网络路径、随机种子、temperature、top-p、超时策略或失败样本,因此复现只能做到指标与工作负载层面的近似复核。

  • Intelligence Index 的页面正文列出 10 个组成评测,但没有为 MiMo-V2.6-Pro 提供每项得分、各项样本量、置信区间或逐题日志;46.324 适合作为聚合比较信号,不应拆解为单项能力结论。

  • Provider 页只有 Xiaomi 一个 provider。$0.13 每任务、$0.18 blended price 和 17.58 秒首答延迟均不能外推到未列出的 provider。

  • 页面价格是每百万 token 的公开计价;完整 Intelligence Index 的 $206.66 是 Artificial Analysis 评测支出,不能当作普通用户一次会话的价格。

  • 模型页的 #1 / 114 与图表中的 “28 of 656 models” 属于不同筛选/展示上下文;二者不能混写成同一排名。

  • Artificial Analysis 的 X 账号 https://x.com/ArtificialAnlys 已通过 Tabbit 打开,但时间线返回“似乎你的连接已断开。我们将继续重试”,没有看到任何与 MiMo-V2.6-Pro 直接相关的帖子,故不引用标题、摘要或转述补写数据。

来源摘录或观察(仅做合规短引)

  • 模型页 Dataset 对测量方法的公开描述:Independent test run by Artificial Analysis on dedicated hardware.

  • Provider 页提示:默认性能基准工作负载已更新为 10k input tokens。

  • Provider 页的结构化数据同时给出 Xiaomi 的 129.74879744631201 output tokens/s、15.414401053139381 秒 reasoning time 和 2.1672836154999802 秒 input processing time;本篇将这些原始字段保留到足够精度,并把四舍五入值单独列为页面展示值。

能支持的判断

  • 需要较强综合推理能力、长上下文、多模态输入或 Agent 工作流,同时重视 API 单价和输出速度的任务;AA 页面给出的输入模态包括文本、图像、语音和视频,上下文窗口为 1M tokens。

不能支持的判断

  • 对首字响应极敏感的交互式短问答;需要按不同 provider、不同推理档位或不同随机种子做严格横向复验的任务;本页只有 Xiaomi 一个 provider,无法代表其他部署。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

Artificial Analysis · Artificial Analysis · 原文发布日期 2026-09-22 · 本站编辑日期 2026-09-22

打开原始来源

MiMo-V2.6-Pro

在 Tabbit 中比较 MiMo-V2.6-Pro

下载 Tabbit 客户端后检查模型可用性

模型深度阅读

完整测评 · 简体中文

MiMo-V2.6-Pro 测评:最聪明的开源模型,却让你等 18 秒

MiMo-V2.6-Pro 公开证据测评:真实任务成败实录、18 秒等待与思考账单、社区原声两极分化,以及按工作负载给出的选型裁决。

定价 · 简体中文

MiMo-V2.6-Pro 定价解析:官方费率表、缓存杠杆与任务成本精算

一份关于 MiMo-V2.6-Pro 定价的实用采购决策指南:官方 API 费率、Prompt 缓存经济学、思考 Token 增量、UltraSpeed 极速模式及实际任务预算测算。

替代品 · 简体中文

MiMo-V2.6-Pro 替代品:按任务和预算选模型

用完成任务的真实成本、agent 可靠性、开源权重和部署条件,横向评估五个 MiMo-V2.6-Pro 替代方案,价格核对时间为 2026 年 9 月 22 日。

模型对比 · 简体中文

MiMo-V2.6-Pro 对比 MiMo-V2.6-Flash:小米 MoE 模型选型深度评测

深度实测小米 MiMo-V2.6-Pro 与 Flash:1.02T 对比 309B MoE 架构、3.1 倍 API 费率差异、前缀缓存经济学、长程 Agent 基准与场景选型决策矩阵。

相关评测

小米 MiMo 官方发布:MiMo-V2.6-Pro 基准信号与原生全模态定位小米官方把 MiMo-V2.6-Pro 定位为面向 Agent、代码、视觉与电脑操作的原生全模态开源模型,并自报 Artificial Analysis Intelligence Index 46 分及多项 RL/Agent 结果;这些数字仍是厂商发布口径,不能替代同一 harness 下的独立复测。MiMo-V2.6-Pro 官方技术报告:架构、规模化 RL 与评测条件这份官方报告把 MiMo-V2.6-Pro 定义为 1.02T 总参数、约 42B 激活参数的原生全模态稀疏 MoE,并用大批量、多环境、多 harness 和 groupwise grader 的 RL 训练获得较强 Agent 基准成绩;但表中大部分数字是厂商自报,公开信息仍不足以独立复现每个 benchmark。MiMo-V2.6-Pro 官方 X 发布线程:任务定位、公开基准与开源入口这条官方线程把 MiMo-V2.6-Pro 定位为公开构建的原生全模态 Agent 模型,重点覆盖代码、计算机使用、3D、设计、科研和工具工作流;线程中的榜单与案例能帮助筛选任务方向,但仍是厂商口径,不能替代同一 harness 下的独立复测。Arena Code Arena:MiMo-V2.6-Pro 的 WebDev AutoEval 记录Arena 的 Code Arena | WebDev 总榜已收录 mimo-v2.6-pro,显示 AutoEval 分数 1628(+18/-18),但没有公开投票数或名次,因此只能说明它进入了 WebDev 自动评测榜,不能把 1628 当作盲投排名。小米 MiMo-V2.6-Pro 官方 API 接入与推理配置这份官方配置可直接用于通过 OpenAI 兼容协议接入 mimo-v2.6-pro,并按任务需要选择深度思考、流式输出和多轮工具调用。Hugging Face 官方 MiMo-V2.6-Pro-RL 本地部署与聊天模板配置官方模型卡已经给出 MiMo-V2.6-Pro-RL 的 SGLang 与 vLLM 服务命令,并在仓库 tokenizer 配置中定义了文本、图像、视频、音频、思考和工具调用的聊天模板;本地部署应使用 checkpoint 名称,不能把它与托管 API 的 mimo-v2.6-pro 当成同一个模型标识。小米 MiMo-V2.6-Pro 全模态输入与视觉任务工作流mimo-v2.6-pro 可通过 OpenAI Chat Completions API 读取公网 URL 或符合格式的 Base64 图像、视频和音频,但不能直接上传本地文件,媒体和文本总 Token 仍受 1M 上下文限制。小米 MiMo-V2.6-Pro 官方函数调用与多轮 Agent 工作流对 mimo-v2.6-pro,官方工作流是“模型返回完整 assistant(包括 reasoning_content 和 tool_calls)→ 客户端执行工具 → 追加 role: tool 结果 → 再请求模型”,直到本轮不再产生工具调用。