Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
提示词与工作流

MiMo-V2.6-Pro · configuration

小米 MiMo-V2.6-Pro 官方 API 接入与推理配置

这份官方配置可直接用于通过 OpenAI 兼容协议接入 mimo-v2.6-pro,并按任务需要选择深度思考、流式输出和多轮工具调用。

来源已核对;未实测OpenAI Chat Completions API、Anthropic Messages API;官方文档还列出 OpenAI 兼容协议下的 TRAE、Cursor、Roo Code、Codex、GitHub Copilot CLI、Zed、AutoGen、Goose。

前置条件与输入

  • 模型 ID
  • 推理或调用参数
  • API 端点
  • 任务说明
  • 验收标准

完整可复制模板

编辑改写:任务模板

Tabbit 编辑改写;非来源原文
调用 MiMo-V2.6-Pro 时固定 {{MODEL_ID}}、{{REASONING_EFFORT}} 和 {{API_BASE}}。任务是 {{TASK}},只使用 {{TOOL_ALLOWLIST}},并用 {{ACCEPTANCE}} 验收。

运行前替换每个变量,并把实际取值写进验收记录。

运行前仍需替换: {{MODEL_ID}}, {{REASONING_EFFORT}}, {{API_BASE}}, {{TASK}}, {{TOOL_ALLOWLIST}}, {{ACCEPTANCE}}

调用 MiMo-V2.6-Pro 时固定 {{MODEL_ID}}、{{REASONING_EFFORT}} 和 {{API_BASE}}。任务是 {{TASK}},只使用 {{TOOL_ALLOWLIST}},并用 {{ACCEPTANCE}} 验收。

查看来源研究笔记

一句话结论

这份官方配置可直接用于通过 OpenAI 兼容协议接入 mimo-v2.6-pro,并按任务需要选择深度思考、流式输出和多轮工具调用。

适用场景

  • 适合的任务:复杂项目、长程任务、高价值工作、网络安全与科研需求;需要多步推理、工具调用、结构化输出或全模态理解的 Agent。

  • 不适合的任务:强实时、对延迟极敏感的交互;此类场景官方建议评估 mimo-v2.6-pro-ultraspeed。高频、规模化且更重视成本的办公任务可评估 mimo-v2.6-flash。

  • 适用的模型版本:mimo-v2.6-pro;本文不将配置外推到其他 MiMo 版本。

  • 适用的客户端、Agent 或 API:OpenAI Chat Completions API、Anthropic Messages API;官方文档还列出 OpenAI 兼容协议下的 TRAE、Cursor、Roo Code、Codex、GitHub Copilot CLI、Zed、AutoGen、Goose,Anthropic 兼容协议下的 TRAE、GitHub Copilot CLI、AutoGen、Goose、OpenClaw、OpenCode、Kilo Code。

  • 推荐的推理档位和参数:复杂推理或 Agent 任务使用 thinking.type: enabled;普通短回答可使用 disabled。非思考调用可使用官方示例的 temperature=1.0、top_p=0.95。深度思考时不要依赖自定义 temperature 或 top_p,官方说明实际会采用推荐默认值 1.0 和 0.95;max_completion_tokens 应覆盖思考内容与最终回答总长度。

可直接使用的内容

下面是根据官方页面整理的最小可运行 OpenAI Python SDK 配置;API Key 只从环境变量读取,不要把真实 Key 写进代码或提交到仓库。

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["MIMO_API_KEY"],
    base_url="https://api.xiaomimimo.com/v1",
)

completion = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[
        {
            "role": "system",
            "content": (
                "You are MiMo, an AI assistant developed by Xiaomi. "
                "Today's date: {date} {week}. "
                "Your knowledge cutoff date is December 2024."
            ),
        },
        {"role": "user", "content": "请完成任务,并先列出关键假设,再给出可验证的结论。"},
    ],
    max_completion_tokens=4096,
    temperature=1.0,
    top_p=0.95,
    stream=False,
    extra_body={"thinking": {"type": "enabled"}},
)

print(completion.model_dump_json())

官方文档给出的中文系统提示词为:

你是MiMo(中文名称也是MiMo),是小米公司研发的AI智能助手。
今天的日期:{date} {week},你的知识截止日期是2024年12月。

官方页面同时提供了英文版本:

You are MiMo, an AI assistant developed by Xiaomi.
Today's date: {date} {week}. Your knowledge cutoff date is December 2024.

如果使用 Anthropic Messages API,可按官方端点改写为:

import os
from anthropic import Anthropic

client = Anthropic(
    api_key=os.environ["MIMO_API_KEY"],
    base_url="https://api.xiaomimimo.com/anthropic",
)

message = client.messages.create(
    model="mimo-v2.6-pro",
    max_tokens=4096,
    system="You are MiMo, an AI assistant developed by Xiaomi. "
           "Today's date: {date} {week}. Your knowledge cutoff date is December 2024.",
    messages=[{"role": "user", "content": "请完成任务,并输出可复核的步骤。"}],
    top_p=0.95,
    temperature=1.0,
    stream=False,
)

这些代码是官方 API 接入与参数配置的合并示例,不是小米公开的任务专用提示词。用户任务本身仍应根据目标补充输入、验收条件和输出格式。

测试/工作流步骤

  1. 在 Xiaomi MiMo API 开放平台创建 API Key,并设置环境变量:

    export MIMO_API_KEY='sk-xxxxx'
    pip install -U openai
  2. 先用 thinking.type: disabled 发送短请求,确认 Base URL、Key 和模型 ID 正确。

  3. 对复杂推理、代码、数学或多步骤 Agent 任务改为 thinking.type: enabled,并把 max_completion_tokens 设为覆盖思考与答案的总预算。

  4. 若使用流式输出,将 stream 设为 True;官方说明思考内容会先以 reasoning_content 增量返回,随后返回最终 content。

  5. 若启用工具调用并继续多轮对话,保存并原样回传每轮 assistant 的 reasoning_content。当历史轮次含工具调用时遗漏该字段,官方说明 API 可能返回 400,并可能导致指令遵循下降或幻觉增多。

  6. 记录每次请求的 model、思考开关、max_completion_tokens、输入与输出 token,以及工具调用是否成功;再用同一任务的关闭思考配置进行延迟和成本对照。

原始证据与数据

模型能力和配额

官方“模型列表”页面在文本生成模型表中列出:

  • 模型 ID:mimo-v2.6-pro

  • 能力:文本生成、全模态理解、深度思考、流式输出、函数调用、结构化输出、联网搜索

  • 上下文窗口:1M

  • 最大输出:128K

  • 限流:最大 RPM 100、最大 TPM 10M

  • 快速选型:复杂项目、长程任务、高价值工作、网络安全与科研需求推荐 mimo-v2.6-pro

同页还将 mimo-v2.6-pro-ultraspeed 定位为强实时场景,将 mimo-v2.6-flash 定位为专业办公中的高频调用与规模化任务。以上是官方选型描述,不代表本文对相邻模型的独立性能结论。

接口和模型 ID

“首次调用 API”页面说明平台兼容 OpenAI API 和 Anthropic API,并给出:

  • OpenAI 实时推理 Base URL:https://api.xiaomimimo.com/v1

  • Anthropic 实时推理 Base URL:https://api.xiaomimimo.com/anthropic

  • OpenAI SDK 调用中的模型:mimo-v2.6-pro

  • Anthropic SDK 调用中的模型:mimo-v2.6-pro

  • 官方示例默认参数:max_completion_tokens=1024、temperature=1.0、top_p=0.95、stream=False

本文示例将 max_completion_tokens 提高到 4096,是为了给深度思考和最终回答留出更实际的总预算;它是配置建议,不是官方固定值。

深度思考

“深度思考”页面明确说明 mimo-v2.6-pro 支持 thinking.type,默认开启;可用 enabled 或 disabled 控制。官方还说明:

  • 深度思考适用于复杂推理、代码生成、数学计算、多步骤分析。

  • 深度思考下不支持自定义 temperature 和 top_p;传入后实际仍采用 1.0 和 0.95。

  • max_completion_tokens 同时限制思考内容和最终回答。

  • 开启思考会增加响应延迟;官方建议复杂任务结合 stream: true 查看实时输出。

  • 多轮工具调用时,必须完整回传带工具调用的 assistant 消息中的 reasoning_content。

官方 Python 参数示例的关键片段为:

extra_body={
    "thinking": {"type": "enabled"}
}

关闭思考时,官方示例改为:

extra_body={
    "thinking": {"type": "disabled"}
}

适用边界

  • 本文只证明官方文档公开了接入方式、参数和模型能力,不证明 mimo-v2.6-pro 在任意具体业务上的独立效果。

  • 官方模型页给出的 1M 上下文和 128K 最大输出是服务限制,不等于每个任务都能稳定获得相同质量或延迟。

  • 深度思考下不要把 temperature、top_p 当作有效调节旋钮;应优先调节提示词、工具定义、上下文和 token 预算。

  • 多轮 Agent 需要持久化 reasoning_content;仅保存最终文本和工具结果可能导致后续请求失败或质量下降。

  • 官方系统提示词中的日期是占位符;实际调用应替换为真实日期和星期,不应照抄过期示例日期。

  • 官方文档列出的知识截止日期为 2024 年 12 月;时效性信息应通过联网搜索工具、外部检索或用户提供的资料核验。

  • 代码示例没有包含真实 Key、工具服务器或业务数据,部署前仍需增加超时、重试、退避、日志脱敏和工具权限控制。

来源摘录或观察

  1. 模型列表(官方,2026-09-21 更新):页面直接列出 mimo-v2.6-pro、1M 上下文、128K 最大输出、文本/全模态/深度思考/函数调用/结构化输出/联网搜索等能力,并将复杂项目、长程任务、高价值工作、网络安全与科研需求作为推荐场景。

  2. 首次调用 API(官方,2026-09-22 更新):页面直接给出 OpenAI 与 Anthropic 两套 Base URL、mimo-v2.6-pro 模型 ID、Python SDK 示例,以及官方推荐的中英文系统提示词。

  3. 深度思考(官方):页面直接说明 Pro 支持 thinking.type,深度思考默认开启;同时给出 extra_body 写法、参数限制、流式输出行为和多轮工具调用中回传 reasoning_content 的要求。

  4. 模型发布日志(官方):页面将 mimo-v2.6-pro 描述为全模态、超高性能、万亿参数的旗舰推理模型,覆盖复杂项目、长程任务、高价值工作、网络安全与科研需求。该描述属于厂商定位,不应当单独当作第三方测评成绩。

来源与日期

小米 Xiaomi MiMo 官方文档 · 原文日期: 2026-09-22 · 编辑日期: 2026-09-22

阅读原始来源
变量检查

仍需替换: 6

{{MODEL_ID}}{{REASONING_EFFORT}}{{API_BASE}}{{TASK}}{{TOOL_ALLOWLIST}}{{ACCEPTANCE}}

相关提示词

Hugging Face 官方 MiMo-V2.6-Pro-RL 本地部署与聊天模板配置小米 MiMo-V2.6-Pro 全模态输入与视觉任务工作流小米 MiMo-V2.6-Pro 官方函数调用与多轮 Agent 工作流

相关测评

小米 MiMo 官方发布:MiMo-V2.6-Pro 基准信号与原生全模态定位Artificial Analysis:MiMo-V2.6-Pro 的智能指数、速度、价格与延迟MiMo-V2.6-Pro 官方技术报告:架构、规模化 RL 与评测条件MiMo-V2.6-Pro 官方 X 发布线程:任务定位、公开基准与开源入口

模型深度阅读

完整测评 · 简体中文

MiMo-V2.6-Pro 测评:最聪明的开源模型,却让你等 18 秒

MiMo-V2.6-Pro 公开证据测评:真实任务成败实录、18 秒等待与思考账单、社区原声两极分化,以及按工作负载给出的选型裁决。

定价 · 简体中文

MiMo-V2.6-Pro 定价解析:官方费率表、缓存杠杆与任务成本精算

一份关于 MiMo-V2.6-Pro 定价的实用采购决策指南:官方 API 费率、Prompt 缓存经济学、思考 Token 增量、UltraSpeed 极速模式及实际任务预算测算。

替代品 · 简体中文

MiMo-V2.6-Pro 替代品:按任务和预算选模型

用完成任务的真实成本、agent 可靠性、开源权重和部署条件,横向评估五个 MiMo-V2.6-Pro 替代方案,价格核对时间为 2026 年 9 月 22 日。

模型对比 · 简体中文

MiMo-V2.6-Pro 对比 MiMo-V2.6-Flash:小米 MoE 模型选型深度评测

深度实测小米 MiMo-V2.6-Pro 与 Flash:1.02T 对比 309B MoE 架构、3.1 倍 API 费率差异、前缀缓存经济学、长程 Agent 基准与场景选型决策矩阵。

MiMo-V2.6-Pro

在 Tabbit 中使用 MiMo-V2.6-Pro

请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。