当任务需要长上下文、图像或视频输入以及持续工具循环时,MiniMax M3 值得受控试用。但它不是 M2.7 的无条件替代:简单任务可能更适合 M2.7,复杂调试也可能需要升级到更强模型。
本页的关键锚点是“容量不等于配额”。MiniMax API 文档在 2026 年 9 月 20 日核对时列出 M3 的总输入加输出上下文为 1,000,000 token,M2.7 为 204,800。Token Plan 和社区报告说明,更大的上下文并不等于更高月度额度或更低的完整任务成本。
重点结论
M3 结合开放权重、1M 总上下文、原生图像/视频输入和 Agent 编码定位。
官方 API 文档给出约 100+ 对 60 token/s 的近似输出速度,但 Provider 和 harness 会改变实测。
API 按量、MiniMax Token Plan、第三方 Provider 与 Tabbit 是不同的获取和计费层。
MiniMax 发布页报告 SWE-Bench Pro 59.0%、Terminal-Bench 2.1 66.0% 和长时间编码案例,这些属于厂商证据。
社区同时报告“便宜好用的工作马”和配额、复杂调试问题,应按工作流理解。
可查看 MiniMax M3 模型页、提示词库 和 评测库。
M3 规格与获取
| 项目 | 当前来源快照 | 边界 |
|---|---|---|
| 模型与发布日期 | MiniMax-M3;发布页日期 2026-06-01 | 托管路线可能暴露不同控制项 |
| 上下文 | 1,000,000 个输入加输出 token | 不是 1M 输入再加无限输出 |
| 模态 | 文本、原生图像/视频输入;发布页称可操作桌面 | 工具权限取决于客户端 |
| API | HTTP、Anthropic SDK、OpenAI SDK | API key 与 Token Plan key 分开 |
| API 计费 | 输入不超过 512K 使用标准费率,超过则更高 | 本次打开页面未显示完整美元表 |
| Token Plan | Plus 20 美元/1.7B、Max 50 美元/5.1B、Ultra 120 美元/9.8B 近似月度 M3 token | 文本、图像、语音、音乐共享池 |
| Tabbit | 公开首页列出 MiniMax M3 | 未验证登录任务、精确额度和 Provider |
官方 API 文档 还列出 M2.7 的 204,800 上下文和约 60 token/s。总 token 数包含输入和输出,所以长资料会挤占回答空间。
四种不同的经济系统
API 按调用计费,API key 与 Token Plan key 分开;发布页称 512K 输入以内和更长输入使用不同费率,但本次核对没有完整美元表,应查看 MiniMax 价格页。不要把 Token Plan token 换算成 API 美元。
Token Plan 发布快照列出 Plus 20 美元、Max 50 美元、Ultra 120 美元,且多种模态共享池。这是订阅额度,不是 API 单价。长上下文、思考、输出和工具仍会影响消耗。
第三方 Provider 可能自定加价、缓存、隐私、区域和 harness。Reddit 用户称某 OpenCode 方案用 10 美元订阅提供约 60 美元的 M3 费率用量,这是个人 Provider 报告,不是 MiniMax 账单。
Tabbit 公开页列出 M3、免费 Trial、设置默认浏览器后增加免费用量的 Standard,以及可选 Pro。公开页没有 M3 精确额度或每模型价格。Tabbit 介绍 和 AI 浏览器对比 只能解释客户端层。
相比 M2.7 的变化
| 维度 | M2.7 | M3 | 应验证什么 |
|---|---|---|---|
| 总上下文 | 204,800 | 1,000,000 | 系统和工具消息后的可用空间 |
| 近似速度 | 约 60 token/s | 100+ token/s | Provider 和并发下的实际速度 |
| 模态 | 文本路线 | 原生图像/视频输入 | 客户端是否传递文件 |
| 思考 | 取决于路线 | API 可切换;Claude Code 默认开启 | 每次比较都记录设置 |
| Agent 定位 | 强 Agent 模型 | 长任务、工具、多模态协作 | harness 同样决定行为 |
Claude Code 配置页要求清除冲突的 Anthropic 环境变量,配置后用 /status 和 /model 检查是否显示 MiniMax-M3。这是获取核验,不是性能保证。
证据说明与场景自检
MiniMax 报告 SWE-fficiency 34.8%、KernelBench Hard 28.8%、MCP Atlas 74.2%,并描述近 12 小时的论文复现、约 24 小时的 Hopper 优化。这些案例支持长反馈循环的试用假设,不代表你的成功率。
Joseph Perla 的 X 实验报告五次 M3 运行在 100 题 DRACO 上得分 68.1,费用 37 美元;比较对象费用是建模值。Reddit 棕地项目讨论称 M3 记住 20 多轮工具调用,而 K2.6 单轮更快。它们都不是标准复现。
| 如果你的工作是 | 起步选择 | 原因 |
|---|---|---|
| 长日志和多轮工具调用的仓库 | M3 API 或 MiniMax Code | 1M 上限和长循环定位相关 |
| 图像/视频研究 | 能传文件的 M3 路线 | 原生输入取决于客户端 |
| 短改写、路由、机械任务 | M2.7 或更快模型 | 上下文更大不等于更省 |
| 复杂且未知的调试 | M3 加升级模型 | 保留失败后的第二条路线 |
| 严格月度配额 | 先测完整会话 | 思考、工具和共享池会影响消耗 |
| 隐私敏感工作 | 查 Provider 区域和留存 | 开放权重不等于托管数据规则 |
可先做一个可撤销任务,记录模型 ID、路线、上下文、思考、工具、耗时、重试、额度和合格结果成本。更多背景见 Agent 推理、浏览器自动化 和 2026 AI 浏览器。
Tabbit 边界与下一步
本次调研检查了 Tabbit 公开页面,页面列出 MiniMax M3,但没有展示登录选择器、模型标签、输出记录或精确额度。因此本文不声称完成 Tabbit M3 实测。发布前应在真实账户中验证模型,运行小型可撤销任务并截取结果。
最终判断
M3 适合长上下文编码、多模态输入和持续 Agent 循环的试用。上下文扩展和长时间案例有价值,但不能把 API、Token Plan、Provider 和 Tabbit 额度合成一个数字,也不能省略复杂调试的升级路线。完成真实 Tabbit 测试和 4–8 条社区截图前,本文保持草稿。
来源
常见问题
MiniMax M3 是什么?
MiniMax M3 是面向编码、Agent 工具调用、长上下文和原生图像/视频输入的开放权重 M 系列模型。官方 API 文档列出 1,000,000 个输入加输出 token 的总上下文上限。
它相比 M2.7 改变了什么?
官方 API 表列出 M3 为 1,000,000 token、M2.7 为 204,800,近似输出速度为 100+ 对 60 token/s。M3 还加入原生多模态和思考开关。
如何获取 M3?
MiniMax 列出 MiniMax Code、Token Plan 和按量 API。API 支持 HTTP、Anthropic SDK 和 OpenAI SDK。第三方 Provider 与 Tabbit 是不同路线。
M3 多少钱?
发布页列出每月 20、50、120 美元的 Token Plan 档位及近似 M3 token 池。它只描述 API 按输入长度计费,本文不把订阅配额当 API 单价。
Tabbit 能用 M3 吗?
Tabbit 公开页面把 MiniMax M3 列为支持模型,但本文没有验证登录后的选择器或运行 M3 任务,公开页也没有展示精确配额和 Pro 价格。
谁适合使用 M3?
长上下文编码、多模态研究和持续 Agent 循环适合试用。简单子任务可保留 M2.7 或更快模型,复杂调试应保留升级路线。