Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
提示词与工作流

MiMo-V2.6-Flash · workflow

MiMo-V2.6-Flash Web Search 工具调用工作流

对 mimo-v2.6-flash,先在 MiMo Console 启用 Web Search Plugin,再通过 OpenAI Chat Completions 的 web_search 工具调用;需要实时信息时可用 force_search: true,用 max_keyword 控制单轮并发关键词数与潜在调用成本。

来源已核对;未实测MiMo API 的 OpenAI Chat Completions;文档称其他 API 协议暂不支持。

前置条件与输入

  • 任务目标
  • 输入材料
  • 工具或步骤约束
  • 验收标准

完整可复制模板

编辑改写:任务模板

Tabbit 编辑改写;非来源原文
用 MiMo-V2.6-Flash 处理 {{TASK}}:先固定 {{MODEL_ID}} 和 {{INPUT_FORMAT}},再按 {{TOOL_STEPS}} 执行,并用 {{ACCEPTANCE}} 核对结果。

运行前替换每个变量,并把实际取值写进验收记录。

运行前仍需替换: {{TASK}}, {{MODEL_ID}}, {{INPUT_FORMAT}}, {{TOOL_STEPS}}, {{ACCEPTANCE}}

用 MiMo-V2.6-Flash 处理 {{TASK}}:先固定 {{MODEL_ID}} 和 {{INPUT_FORMAT}},再按 {{TOOL_STEPS}} 执行,并用 {{ACCEPTANCE}} 核对结果。

查看来源研究笔记

一句话结论

对 mimo-v2.6-flash,先在 MiMo Console 启用 Web Search Plugin,再通过 OpenAI Chat Completions 的 web_search 工具调用;需要实时信息时可用 force_search: true,用 max_keyword 控制单轮并发关键词数与潜在调用成本。

适用场景

  • 适合的任务:新闻、产品、天气等需要实时公开信息的问答;需要返回搜索来源和摘要的 Agent 工作流。

  • 不适合的任务:不需要实时信息的固定知识问答,或未启用插件、无法承担搜索与额外输入 token 成本的调用。

  • 适用的模型版本:mimo-v2.6-flash(官方支持列表明确列出);本文不将 Pro、Pro UltraSpeed 或旧版模型的示例结果归因于 Flash。

  • 适用的客户端、Agent 或 API:MiMo API 的 OpenAI Chat Completions;文档称其他 API 协议暂不支持。

  • 推荐的推理档位和参数:文档未提供 Flash 专属推理档位建议。工具调用使用 tool_choice: "auto";需强制联网时设置 force_search: true,并按成本上限设置 max_keyword。

可直接使用的内容

下面是基于官方支持列表和 Web Search 工具示例整理的 Flash 配置骨架。官方页面的完整示例把 model 写成 mimo-v2.6-pro,因此不把其 Pro 输出当作 Flash 测试结果;将模型 ID 指定为官方支持的 mimo-v2.6-flash 后,再按业务填写消息内容和位置参数。

completion = client.chat.completions.create(
    model="mimo-v2.6-flash",
    messages=[
        {"role": "user", "content": "需要实时信息的问题"}
    ],
    tools=[
        {
            "type": "web_search",
            "max_keyword": 3,
            "force_search": True,
            "limit": 1,
            # 可选:按业务提供近似位置
            "user_location": {
                "type": "approximate",
                "country": "China",
                "region": "Hubei",
                "city": "Wuhan"
            }
        }
    ],
    tool_choice="auto"
)

参数含义以原文为准:force_search 强制搜索;未强制时由模型判断是否需要联网;max_keyword 限制单轮最多搜索关键词数;user_location 用于提供近似位置;tool_choice: "auto" 允许模型决定工具调用。limit 在官方代码中出现,但页面未解释其语义,使用前应以 API 返回和最新参考文档核验。

测试或工作流步骤

  1. 按官方 First API Call 流程准备 API Key,并使用 https://api.xiaomimimo.com/v1 作为 OpenAI 兼容客户端的 base_url。

  2. 进入 Console → Plugin Management,启用 Web Search Plugin。

  3. 注意插件开关有约 5 分钟缓存期;启用或停用后不要立即用结果判断配置是否生效。

  4. 以 mimo-v2.6-flash 发起 Chat Completions 请求,tools 中加入 type: "web_search",并设置 tool_choice: "auto"。

  5. 对必须基于最新网页回答的问题设置 force_search: true;否则允许模型按意图决定是否搜索。

  6. 需要流式输出时,读取首个流式数据包中的搜索来源;流式和非流式响应都应包含搜索与摘要内容。

  7. 若同时传入自定义函数或其他工具,保留模型的自动决策,并在应用侧记录实际调用的工具和来源。

  8. 根据成本上限调整 max_keyword。一轮搜索可并发多个关键词,可能产生多次 Internet Content Plugin 调用;搜索网页内容还会追加到模型输入 token。

原始证据与数据

  • 官方页面将 Web Search 定义为帮助大模型获取新闻、产品、天气等实时公开信息的基础在线搜索工具。

  • 页面列出四项能力:强制搜索与意图识别、流式首包返回全部搜索来源、与自定义工具混合调用、流式和非流式均返回搜索与摘要。

  • 支持模型列表明确包含 mimo-v2.6-flash,也列出 mimo-v2.6-pro、mimo-v2.6-pro-ultraspeed、mimo-v2.5-pro 和 mimo-v2.5;后四者仅作为官方支持列表记录,未用于本文的 Flash 结论。

  • Web Search 费用由两部分组成:搜索插件使用费和模型 token 费。页面标注搜索工具每 1,000 次调用:中国 ¥16,海外 $5;一次搜索轮次可能按 max_keyword 并发调用多次。

  • FAQ 说明:模型可能判断问题不需要实时信息而不搜索;设置 force_search: true 可强制搜索。页面还说明插件开关存在 5 分钟缓存期。

  • 官方示例响应的 model 是 mimo-v2.6-pro,包含 url_citation 来源注释和 web_search_usage 用量字段。该示例不是 Flash 实测,本文不将其天气答案、来源数量或 token 数作为 Flash 数据。

适用边界

  • “官方支持”不等于本文已完成 Flash API 实测;原文没有提供 Flash 专属请求响应、延迟、准确率或 token 数据。

  • force_search: true 只解决是否发起搜索,不保证搜索结果完整或回答准确;应用仍应展示或保存 url_citation 等来源信息并自行校验。

  • max_keyword 越大,单轮可能产生的并发搜索与插件费用越高;应按问题类型设置上限。

  • 示例中的武汉天气、日期、位置和 Pro 模型均属于官方示例上下文,不应直接复制为通用业务结论。

复现说明

采集时完整打开并读取官方 Web Search 页面,页面更新时间为 2026-09-22。复现需准备 MiMo API Key、启用 Web Search Plugin,并以 mimo-v2.6-flash 调用 OpenAI Chat Completions;本文记录的是官方工作流配置,没有声称已在本地完成 API 请求或独立测量。

来源与日期

Xiaomi MiMo 官方文档 · 原文日期: 2026-09-22 · 编辑日期: 2026-09-22

阅读原始来源
变量检查

仍需替换: 5

{{TASK}}{{MODEL_ID}}{{INPUT_FORMAT}}{{TOOL_STEPS}}{{ACCEPTANCE}}

相关提示词

MiMo-V2.6-Flash 深度思考配置与多轮工具调用工作流MiMo-V2.6-Flash 音频理解工作流:URL 与 Base64 输入配置MiMo-V2.6-Flash 结构化输出:JSON 模式配置与校验工作流MiMo-V2.6-Flash 图像理解输入与多图工作流

相关测评

MiMo-V2.6-Flash 官方基准:30 步强化学习与 Agent 结果MiMo-V2.6-Flash-RL Hugging Face 官方基准与部署边界BenchLM:MiMo-V2.6-Flash 与 Pro 的同系列成本和公开基准对比MiMo-V2.6-Flash 官方 X 发布线程:Flash 的基准定位与双模型策略

模型深度阅读

完整测评 · 简体中文

MiMo-V2.6-Flash 深度测评:高吞吐自动化主力,长程规划的有条件升级

基于公开实证与技术基准对小米 MiMo-V2.6-Flash 的深度测评:解析 15B 激活 MoE 吞吐、基准局限、长程纠错悬崖、计费机制与工作负载选型。

定价 · 简体中文

MiMo-V2.6-Flash 定价解析:官方费率表、缓存杠杆与任务成本精算

一份关于 MiMo-V2.6-Flash 定价的实用采购决策指南:官方 API 费率、Prompt 缓存经济学、MoE 高吞吐架构与大规模任务预算测算。

模型对比 · 简体中文

MiMo-V2.6-Pro 对比 MiMo-V2.6-Flash:小米 MoE 模型选型深度评测

深度实测小米 MiMo-V2.6-Pro 与 Flash:1.02T 对比 309B MoE 架构、3.1 倍 API 费率差异、前缀缓存经济学、长程 Agent 基准与场景选型决策矩阵。

MiMo-V2.6-Flash

在 Tabbit 中使用 MiMo-V2.6-Flash

请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。