LongCat 2.0 mérite un pilote si vous avez besoin d’un long contexte, de poids ouverts ou d’un agent peu coûteux. Ce n’est pas simplement un « modèle de frontière bon marché » : le chemin d’accès, le format des outils, les données et la relecture humaine comptent autant que le prix par token.
Le repère est l’annonce officielle du 30 juin 2026 et la fiche vérifiée le 20 septembre 2026 : 1,6 T de paramètres, environ 48 Md actifs, contexte 1M et licence MIT. Le même jour, OpenRouter affichait 0,30/1,20 dollar par million de tokens en entrée/sortie. Ces chiffres ne décrivent ni une session Tabbit, ni une machine locale, ni une facture de première partie. Commencez par la page du modèle LongCat 2.0 (English).
L’essentiel
Poids publiés, contexte 1M et exemples Transformers, vLLM et SGLang.
Les résultats officiels décrivent une couverture de tâches, pas un classement indépendant.
Le prix OpenRouter est un instantané daté et ne remplace pas une politique de données.
Les retours parlent d’un agent fiable, mais aussi de code défectueux, de répétition et de frictions d’intégration.
Fiche et accès
| Sujet | Donnée vérifiée | Limite |
|---|---|---|
| Modèle | MoE sparse, 1,6 T total, 48 Md actifs | Ne prédit pas directement latence ou coût total. |
| Contexte | 1M dans la fiche et chez OpenRouter | Client et mémoire peuvent le réduire. |
| Licence | MIT, poids publiés | L’infrastructure et la sécurité restent à votre charge. |
| Code | Terminal-Bench 70,8 ; SWE-Bench Pro 59,5 | Ne garantit pas votre dépôt. |
| OpenRouter | 0,30/1,20 dollar par million, AtlasCloud | Prix et disponibilité évoluent. |
Lisez ce qu’est un navigateur agentique, la comparaison de navigateurs IA et les bonnes pratiques de Tabbit Browser pour séparer produit, API et workflow.
Architecture et conditions des scores
L’article technique décrit LongCat Sparse Attention avec indexation streaming, inter-couches et hiérarchique, ainsi qu’un N-gram Embedding de 135B. Il mentionne un entraînement sur des centaines de milliards de tokens de contexte 1M. Les intégrations Claude Code, OpenClaw et Hermes montrent une orientation code et outils, mais ne garantissent pas que chaque harness accepte le même emballage d’appel. Consultez les prompts LongCat (English) sans recopier d’instruction système.
La table officielle donne Terminal-Bench 2.1 70,8, SWE-Bench Pro 59,5, SWE-Bench Multilingual 77,3, FORTE 73,2, BrowseComp 79,9, RWSearch 78,8 et IFEval 90,0. La fiche précise que les valeurs sans astérisque sont internes. L’article indique Claude Code, 8c16g et six heures pour Terminal-Bench, 4c8g et des tâches corrigées pour SWE-Bench, puis 15 métiers, 45 minutes et 2 CPU/4GB pour FORTE. Ces informations rendent le chiffre lisible, mais ce n’est pas une réplication indépendante. Voir les revues LongCat (English).
Prix et risques selon la route
L’auto-hébergement donne du contrôle sur les documents et le code, mais vous assumez matériel, quantification, supervision, mises à jour et sécurité. La revue eesel du 4 août 2026 décrit une route promotionnelle et des contraintes régionales ; c’est une liste de questions, pas une facture actuelle. OpenRouter affichait le 20 septembre 0,30/1,20 dollar, 0,006 en lecture de cache, contexte 1M et AtlasCloud : c’est une route fournisseur, pas un SLA du modèle.
Tabbit est une session produit distincte. Aucun test authentifié ni aucune capture admissible n’a été produit pour cet article ; nous ne prétendons donc rien sur qualité, latence, disponibilité ou prix dans Tabbit. Commencez par une page publique et une tâche réversible. La documentation d’automatisation du navigateur ne transforme pas une session en compte API.
Reddit rapporte personnellement environ 2 dollars pour 50M de tokens, sans facture ni répétition contrôlée. Un autre utilisateur apprécie le suivi des instructions en role-play non raisonné mais signale de la répétition sur les longs textes. Un post X décrit un bon résultat de physique visuelle dans un test partagé, sans prompt ni barème. Eesel cite aussi des expériences positives et négatives en code. Ce sont des signaux pour un pilote, pas un classement. Utilisez la recherche agentique pour fixer votre propre critère.
Vérifiez avant déploiement la rétention, l’entraînement, la résidence et le SLA, la compatibilité de <longcat_tool_call>, la langue des réponses de recherche et le coût de l’énergie, du matériel et des reprises. 1M est une limite maximale, pas la promesse d’une entrée stable et bon marché.
Premier essai et verdict
Pour le code, utilisez un petit dépôt, un diff fixe et des tests. Pour la recherche, datez les documents et notez les citations. Pour une entreprise sensible, obtenez les conditions par écrit. Si LongCat apparaît dans Tabbit, demandez cinq points et leurs liens depuis une documentation publique, puis vérifiez-les à la main et n’accordez pas l’écriture au premier essai.
LongCat 2.0 est un candidat crédible pour un pilote de code, de recherche et d’agents à long contexte. Les poids ouverts et le snapshot de prix facilitent l’essai, mais les outils, la qualité acceptée et les conditions de données doivent être validés sur la route réelle. Ne prenez pas le prix d’entrée seul pour le contrat opérationnel. Les détails sont dans la collection de revues LongCat (English).
Sources
Questions fréquentes
Qu’est-ce que LongCat 2.0 ?
C’est un modèle sparse mixture-of-experts de Meituan sous licence MIT. Sa fiche officielle indique 1,6 billion de paramètres au total, environ 48 milliards actifs par token et un contexte d’un million de tokens.
LongCat 2.0 est-il open source ?
La fiche Hugging Face officielle publie les poids sous licence MIT et fournit des exemples Transformers, vLLM et SGLang. Les poids ouverts ne rendent pas le matériel et l’exploitation gratuits.
Quel est le prix de LongCat 2.0 ?
Le 20 septembre 2026, OpenRouter affichait 0,30 dollar par million de tokens en entrée et 1,20 en sortie. Il s’agit d’un instantané de fournisseur, pas d’un prix universel ni d’un tarif Tabbit.
Est-il adapté aux agents de code ?
Le tableau officiel indique 70,8 à Terminal-Bench 2.1 et 59,5 à SWE-Bench Pro selon ses propres harnesses. Commencez par un dépôt réversible et des critères d’acceptation.
Les données API sont-elles protégées ?
Les sources publiques consultées ne suffisent pas à établir une politique complète de rétention, d’entraînement, de résidence ou de SLA. Demandez les conditions actuelles au fournisseur choisi.
Puis-je l’utiliser dans Tabbit ?
Aucun test LongCat 2.0 authentifié n’a été exécuté dans Tabbit pour cet article. Vérifiez le sélecteur et les conditions du compte en direct.