MiMo-V2.6-Pro · 媒体来源 · 平台遥测
Arena 的 Code Arena | WebDev 总榜已收录 mimo-v2.6-pro,显示 AutoEval 分数 1628(+18/-18),但没有公开投票数或名次,因此只能说明它进入了 WebDev 自动评测榜,不能把 1628 当作盲投排名。
Arena 的 Code Arena | WebDev 总榜已收录 mimo-v2.6-pro,显示 AutoEval 分数 1628(+18/-18),但没有公开投票数或名次,因此只能说明它进入了 WebDev 自动评测榜,不能把 1628 当作盲投排名。
适合的任务:前端 Web 开发,以及需要多步推理和工具调用的 Agentic Coding 工作流。
不适合的任务:不能据此判断通用文本、视觉、多模态、长文写作或真实项目交付质量;也不能据此判断人类偏好。
适用的模型版本:mimo-v2.6-pro,页面模型别名为 mimo-v2.6-pro。
适用的客户端、Agent 或 API:Arena Code Arena 的 WebDev 评测环境;页面未公开具体 harness、工具 schema、系统提示词或 API 提供商配置。
推荐的推理档位和参数:页面未公开推理档位、温度、采样参数或工具配置,不应自行补写。
打开 Arena 官方 Code leaderboard:https://arena.ai/leaderboard/code。
使用页面默认的 Ranking、Overall、Models 视图,记录榜单标题、页面日期、总投票/会话统计和模型总数。
在模型表格中定位精确别名 mimo-v2.6-pro,不要把 mimo-v2.5-pro、mimo-v2-pro 或 mimo-v2-flash 合并到本条记录。
分别记录 Rank、Rank Spread、Score、Votes、价格和上下文;若字段显示 N/A,保留 N/A,不要用邻近模型或官方宣传数据替代。
| 字段 | Arena 页面原值 | |
|---|---|---|
| 榜单 | `Code Arena | WebDev` |
| 类别 | Overall | |
| 页面说明 | 面向前端 Web 开发任务,包括需要多步推理和工具使用的 Agentic Coding 工作流 | |
| 页面标注日期 | 2026-09-12 | |
| 总投票 | 679,295 votes | |
| 模型数 | 129 models | |
| 自动评测标记 | 1 AutoEval |
mimo-v2.6-pro 行| 字段 | 原值 | 解释 |
|---|---|---|
| Model | mimo-v2.6-pro | Xiaomi · MIT |
| Rank | N/A | 没有公布可排序的名次 |
| Rank Spread | N/A | 没有公布名次区间 |
| Score | 1628 | 该行标记为 AutoEval |
| Score Spread | +18/-18 | 页面显示的分数区间 |
| Votes | N/A | 不是公开盲投票数 |
| Price $/M | $0.43 / $0.87 | 页面元数据,输入/输出价格顺序 |
| Context | 1M | 页面元数据 |
这里的关键区别是:榜头同时显示 679,295 votes,但 mimo-v2.6-pro 自身的 Votes 为 N/A,并且该行 Rank 为 N/A、分数旁有 AutoEval 标记。因此不能写成“MiMo 在 Arena 盲测中排名第 X”,也不能把 1628 与有公开 Votes 的模型做严格胜负比较。
这是 Arena 官方页面上的独立评测记录,但页面没有说明该 AutoEval 的任务集、样本数、评测脚本、工具版本、推理档位或提供商路由;这些缺失项限制了复现和横向比较。
榜单只覆盖 Code/WebDev 的 Overall 视图;该条记录不能外推到通用聊天、视觉理解或全模态能力。
价格和上下文长度是榜单展示的模型元数据,不是本次 AutoEval 的质量结果,且可能随时间更新。
同一页面中,其他模型的公开投票分数与 MiMo 的 AutoEval 分数属于不同证据类型;应在报告中分栏呈现。
采集时核对了 Arena 官方 X 账号 @arena 及 from:arena MiMo 的最新搜索入口;X 时间线停留在加载状态并出现 ChunkLoadError/fetchError,未取得可核对的推文正文,因此没有把 X 搜索摘要或转述写入结论。
Arena 的 Text 页面在采集时未出现精确别名 mimo-v2.6-pro,Agent 页面只出现 Mimo V2.5 Pro;这两项不能作为 MiMo-V2.6-Pro 的 Text/Agent 成绩,也不应与本条 WebDev AutoEval 合并。
榜单顶部提示:mimo-v2.6-pro's AutoEval score is now on Arena。
模型行原始字段:mimo-v2.6-pro · Xiaomi · MIT · 1628 · +18/-18 · AutoEval · N/A · $0.43/$0.87 · 1M。
页面说明明确将该榜单定义为前端 Web 开发任务,并包含需要多步推理和工具使用的 Agentic Coding 工作流。
本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。
需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。
Arena(官方 leaderboard) · Arena · 原文发布日期 2026-09-12 · 本站编辑日期 2026-09-22
打开原始来源MiMo-V2.6-Pro
下载 Tabbit 客户端后检查模型可用性