MiMo-V2.6-Flash · workflow
官方文档将 mimo-v2.6-flash 列为视频理解支持型号,可通过公开视频 URL 或带 MIME 前缀的 Base64 Data URL 输入视频,并用 fps 与 media_resolution 控制时序和单帧细节;页面示例使用 mimo-v2.6-pro,不构成 Flash 的实测结果。
官方文档将 mimo-v2.6-flash 列为视频理解支持型号,可通过公开视频 URL 或带 MIME 前缀的 Base64 Data URL 输入视频,并用 fps 与 media_resolution 控制时序和单帧细节;页面示例使用 mimo-v2.6-pro,不构成 Flash 的实测结果。
适合的任务:公开视频分析、内容描述、动作或时间变化理解,以及需要按成本和细节调节视频采样的任务。
不适合的任务:直接上传本地视频文件的流程;官方 FAQ 明确说明当前不支持本地视频文件上传。也不要把 Pro、Pro UltraSpeed 或旧版模型的示例输出外推为 Flash 效果。
适用的模型版本:mimo-v2.6-flash。原文同时列出 mimo-v2.6-pro、mimo-v2.6-pro-ultraspeed 和 mimo-v2.5;本文只将支持列表结论归于 Flash。
适用的客户端、Agent 或 API:MiMo API 的 OpenAI Chat Completions API;原文示例使用 Python SDK 和 Curl。
推荐的推理档位和参数:原文示例使用 fps=2、media_resolution="default" 和 max_completion_tokens=1024,但示例模型是 Pro,不能据此声称这些是 Flash 的最优参数。按视频时长、动作密度、细节要求和上下文预算调整。
下面是按官方支持列表将请求模型设置为 mimo-v2.6-flash 的复现骨架。官方页面的 Quick Start、URL、Base64 代码及响应示例均使用 mimo-v2.6-pro,因此下面的 Flash 版本表达的是官方支持范围与请求格式,不是官方提供的 Flash 实测响应。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ.get("MIMO_API_KEY"),
base_url="https://api.xiaomimimo.com/v1",
)
completion = client.chat.completions.create(
model="mimo-v2.6-flash",
messages=[
{
"role": "user",
"content": [
{
"type": "video_url",
"video_url": {
"url": "https://example.com/video.mp4",
},
"fps": 2,
"media_resolution": "default",
},
{
"type": "text",
"text": "Please describe the content of the video.",
},
],
}
],
max_completion_tokens=1024,
)
print(completion.model_dump_json())URL 必须能被服务端公开访问,且单个视频文件不超过 300 MB。
公开视频 URL 不可用时,先将视频编码为 Base64,再把带 MIME 前缀的 Data URL 放进同一个字段:
data:{MIME_TYPE};base64,$BASE64_VIDEO{MIME_TYPE} 替换为实际视频 MIME 类型;$BASE64_VIDEO 只放纯 Base64 内容,不重复添加前缀。编码后的单个视频字符串不超过 50 MB。
准备 MiMo API Key,并使用 https://api.xiaomimimo.com/v1。
将 model 设置为 mimo-v2.6-flash;不要把 Pro、Pro UltraSpeed 或旧版模型的响应当作 Flash 结果。
选择输入方式:已有公网资源使用 URL;无法通过公网访问的视频使用带 MIME 前缀的 Base64 Data URL。
在 user message 的 content 数组中放入视频块和文字任务;描述、摘要、动作识别等目标应写清楚。
按任务调节 fps 和 media_resolution,发送请求并读取 API 响应中的 usage。
记录真实的 video_tokens 与 audio_tokens;不要用估算值替代 API 实际计量。
模型支持:页面 Supported models 明确列出 mimo-v2.6-flash,并同时列出 mimo-v2.6-pro、mimo-v2.6-pro-ultraspeed 和 mimo-v2.5。
输入方式:支持公开视频 URL 和 Base64 编码;当前不支持本地视频文件上传。
视频格式:MP4、MOV、AVI、WMV;格式变体较多,官方要求通过实际测试确认能否正常识别。
大小限制:URL 方式单个视频不超过 300 MB;Base64 方式单个编码字符串不超过 50 MB。
多视频限制:多个视频的数量受模型上下文长度限制,全部视频与文字 token 总量必须小于模型上下文长度。
采样控制:fps 默认值为 2,范围 [0.1, 10];数值越高,帧提取越密集、时间细节越丰富、token 消耗越高。media_resolution 默认值为 default,也可设为 max;max 用于增强小物体和纹理细节识别。
token 估算:官方提供 Python 估算函数。其可见参数包括视频时长、宽高、fps、media_resolution 和是否静音;估算结果仅供参考,实际消耗以 API 响应为准。音频部分给出的近似关系为 audio_tokens ≈ 音频时长(秒) × 6.25。
官方示例的版本边界:页面示例请求和响应中的 model 均为 mimo-v2.6-pro,其中的 kitten 描述、推理内容、token 用量和响应模型名均不是 Flash 数据。
页面时间:正文显示 Update Time September 22, 2026,未单独公开发布日期。
mimo-v2.6-flash 的直接证据是官方支持列表;页面没有提供 Flash 专属输入、响应、延迟、质量或 token 基线。
fps=2、media_resolution="default" 和 max_completion_tokens=1024 来自 Pro 示例,只能作为起始配置,不能宣称为 Flash 推荐值。
URL 必须能被 MiMo 服务端访问,浏览器本地路径不满足 URL 输入要求;Base64 限制针对编码后的字符串,编码会增加体积。
视频数量还受上下文长度约束;视频 token 估算函数不能替代 API 返回的真实计量。
不应把 mimo-v2.6-pro、mimo-v2.6-pro-ultraspeed 或 mimo-v2.5 的输出质量、推理 token 和性能外推到 mimo-v2.6-flash,也没有证据表明该页面适用于 MiMo-V2.6-Flash-RL。
打开原文,确认 Supported models 仍包含 mimo-v2.6-flash,并核对页面更新时间。
准备一个符合格式和大小限制的公开视频 URL,或生成带 MIME 前缀的 Base64 Data URL。
使用上面的 Chat Completions 结构,将 model 保持为 mimo-v2.6-flash,提交一个明确的视频描述或分析任务。
保存原始响应和 usage 字段,将其标记为 Flash 的独立复现结果;不要引用官方 Pro 示例响应作为 Flash 结果。
如需调节成本或细节,分别改变 fps、media_resolution,并记录实际 token 用量与视频格式、时长等输入条件。
Xiaomi MiMo 官方文档 · 原文日期: 未公开 · 编辑日期: 2026-09-22
阅读原始来源MiMo-V2.6-Flash
请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。