Hôte et identifiants
Les requêtes OpenAI à l'usage utilisent https://api.xiaomimimo.com/v1 et l'en-tête api-key. Token Plan utilise son hôte et un identifiant tp-xxxxx.
MIMO 2.5 PRO API
Une requête valide a besoin du bon hôte Xiaomi, de l'en-tête api-key, de l'ID exact du modèle et d'un corps accepté par MiMo. Commencez par les symptômes, puis vérifiez thinking, le streaming, le contexte et le fournisseur.
Documentation officielle vérifiée le 27/08/2026. MiMo-V2.5-Pro n'est pas dans le sélecteur actuel de Tabbit, qui est donc présenté comme une autre voie avec des modèles compatibles.

CE QUE DISENT LES DOCS
Xiaomi documente deux familles de Base URL, un ID de modèle et les formats compatibles OpenAI et Anthropic. Les résultats communautaires mentionnent aussi des rejets de fournisseurs et des appels qui consomment des tokens d'entrée sans sortie utile. Ce ne sont pas des garanties de service.
Les requêtes OpenAI à l'usage utilisent https://api.xiaomimimo.com/v1 et l'en-tête api-key. Token Plan utilise son hôte et un identifiant tp-xxxxx.
L'exemple officiel utilise mimo-v2.5-pro et /chat/completions. Validez messages avant de modifier l'échantillonnage ou les champs d'agent.
Le raisonnement profond renvoie reasoning_content. Pour les appels d'outils multi-tours, Xiaomi demande de renvoyer le champ complet, sinon l'API peut renvoyer 400.
REQUÊTE MINIMALE
Voici la forme compatible OpenAI des docs, réduite aux champs qui confirment la route. Gardez la clé dans une variable d'environnement.
BASE COPIABLE
curl --location --request POST 'https://api.xiaomimimo.com/v1/chat/completions' \
--header "api-key: $MIMO_API_KEY" \
--header "Content-Type: application/json" \
--data-raw '{"model":"mimo-v2.5-pro","messages":[{"role":"user","content":"Hello"}],"max_completion_tokens":1024,"stream":false}'L'exemple officiel montre aussi max_completion_tokens, temperature 1.0, top_p 0.95, stream false et les pénalités. Le raisonnement profond peut imposer les valeurs recommandées.
Pour le paiement à l’usage, utilisez https://api.xiaomimimo.com/v1. Pour Token Plan, remplacez-le par le Base URL dédié après abonnement.
Utilisez api-key: $MIMO_API_KEY et Content-Type: application/json. Tous les clients OpenAI ne transforment pas Authorization en en-tête documenté.
Définissez model sur mimo-v2.5-pro. Un gateway peut publier un autre slug, copiez donc son ID actuel.
Envoyez un seul message user. Ajoutez tools, thinking et stream après une completion valide.
RAISONNEMENT, STREAMING, CONTEXTE
Traitez le comportement de l'API comme un test. Une réponse finale vide peut venir d'un client qui ne lit que content alors que le texte est dans reasoning_content, ou d'un budget consommé par le raisonnement.
Envoyez {"type":"enabled"} ou {"type":"disabled"}. Xiaomi indique que mimo-v2.5-pro et mimo-v2.5 sont activés par défaut. Dans le SDK Python, utilisez extra_body.
En streaming, les fragments reasoning_content arrivent avant ceux de content. Accumulez les deux, arrêtez-vous à finish_reason et traitez usage avant [DONE].
N'inventez pas une fenêtre de contexte non documentée. Gardez messages dans la limite du modèle et du compte. max_completion_tokens couvre le raisonnement et la réponse finale.
Xiaomi indique que temperature et top_p personnalisés ne sont pas effectifs en raisonnement profond. Les valeurs recommandées sont 1.0 et 0.95. Vérifiez la réponse réelle du serveur.
DIFFÉRENCES DE ROUTE
La compatibilité OpenAI décrit le format de requête, pas la facturation, les alias, les en-têtes, les quotas, la modération ou le streaming. Notez l'hôte et le fournisseur avec chaque échec.
| Contrôle | Xiaomi officiel | Gateway ou fournisseur |
|---|---|---|
| Base OpenAI | https://api.xiaomimimo.com/v1 | Utilisez le Base URL actuel du fournisseur |
| Token Plan | https://token-plan-cn.xiaomimimo.com/v1 avec tp-xxxxx | Généralement distinct de la clé à l’usage |
| Champ model | mimo-v2.5-pro | Copiez le slug exact du catalogue |
| Auth | api-key: MIMO_API_KEY | Suivez le format du fournisseur |
| Limites et règles | Consultez les usages et la console Xiaomi | Consultez quota, modération, RPM, TPM et concurrence |
LISTE DES CODES
Ne changez qu’une variable à la fois. Enregistrez hôte, modèle, réponse et heure avant de réessayer.
Corps mal formé, champ non pris en charge, messages invalide ou historique d’outil sans reasoning_content.
Rejouez la requête minimale et vérifiez JSON, model, messages, position de thinking et renvoi complet de reasoning_content.
Clé absente, expirée, préfixe incorrect ou mauvais en-tête.
Chargez la clé depuis une variable d’environnement et utilisez api-key. N’affichez jamais le secret.
Compte ou route non autorisé, ou politique du gateway.
Confirmez compte, hôte du plan, accès au modèle, politique et modération.
Chemin d’hôte ou alias de modèle inexistant.
Vérifiez /v1/chat/completions, le Base URL et le catalogue actuel. N’ajoutez pas /v1 deux fois.
Limite de débit, tokens, concurrence ou quota dépassée.
Vérifiez les limites actives, appliquez un backoff avec jitter et réduisez le parallélisme.
La requête finit sans content ou le stream semble bloqué.
Journalisez chaque delta, reasoning_content et finish_reason. Augmentez max_completion_tokens, vérifiez le parseur et testez thinking disabled.
UNE VOIE NAVIGATEUR SANS API
Le sélecteur Tabbit actuel n'affiche pas MiMo-V2.5-Pro. Nous ne promettons donc pas une intégration en un clic. Pour la recherche et la comparaison de réponses, choisissez un modèle réellement listé dans Tabbit et séparez ce flux du dépannage API.

Le sélecteur du nouvel onglet montre les modèles disponibles. Aucune clé Xiaomi ni Base URL à copier.

Posez une question sur la page actuelle ou référencez pages et fichiers depuis le navigateur. C’est un autre problème qu’une requête brute.

Tabbit peut afficher les réponses de modèles compatibles côte à côte et utiliser Deep Research pour réunir sources et étapes.
QUELLE VOIE CHOISIR
MiMo via Xiaomi convient quand vous possédez l'intégration. Tabbit est plus direct pour travailler sur des pages avec un modèle compatible.
| Besoin | MiMo API | Tabbit |
|---|---|---|
| Identifiants | Créer et protéger une clé Xiaomi ou fournisseur | Utiliser les modèles du sélecteur |
| Contrôle | Choisir hôte, modèle, corps, raisonnement, outils et stream | Questionner depuis le contexte du navigateur |
| État outil | Conserver reasoning_content de assistant | Pas de rejeu manuel des messages API |
| Recherche web | Construire recherche, fetch et citations | Utiliser pages et Deep Research |
FAQ API MIMO
Pour OpenAI compatible à l’usage, Xiaomi documente https://api.xiaomimimo.com/v1 et /chat/completions. Token Plan a un autre Base URL.
Le curl officiel utilise api-key: $MIMO_API_KEY. Gardez la clé dans une variable et vérifiez les exigences du gateway.
L’exemple Xiaomi utilise mimo-v2.5-pro. Un gateway peut avoir un alias différent : utilisez son ID exact.
Envoyez thinking.type enabled ou disabled. Dans le SDK Python, utilisez extra_body. Xiaomi indique que les deux modèles V2.5 sont actifs par défaut.
Le raisonnement consomme le budget et ajoute de la latence. En streaming, reasoning_content arrive avant content. Accumulez les deux et vérifiez finish_reason.
Avec raisonnement et outils, Xiaomi demande de renvoyer tout reasoning_content dans le prochain message assistant. Sinon le contexte est incomplet.
Ne copiez pas un nombre non confirmé depuis un site tiers. Vérifiez les limites actuelles du modèle et du compte et gardez de la place pour la réponse.
Il n’est pas dans le sélecteur actuel. Utilisez Xiaomi ou un gateway pour l’API, et un modèle listé dans Tabbit pour la recherche web.
Rejouez la requête minimale Xiaomi, puis ajoutez thinking, tools et streaming un par un. Pour les pages, utilisez un modèle Tabbit compatible sans créer de clé API.
La disponibilité et les limites changent. Vérifiez les docs officielles avant publication.