Mistral Small 3.2 24B
Checkpoint instruct officiel
Une base claire pour les consignes précises, le chat multilingue et Apache-2.0.
Son comportement généraliste peut sembler moins littéraire ou moins proactif qu’un tune RP.
Ouvrir la model card ↗MISTRAL 24B / GUIDE RP
Le bon choix dépend de votre fiche de personnage, de votre matériel et du style recherché. Notez l’identifiant complet du dépôt, puis comparez la voix, la cohérence, l’initiative, les répétitions, le contexte et la licence. Cette page sépare les faits officiels des retours communautaires.

VERDICT CONDITIONNEL
Ce sont des points de départ vérifiables, pas un classement universel. Les cards et les commentaires ne reposent pas sur les mêmes tests. Validez chaque hypothèse avec votre propre fiche.
Checkpoint instruct officiel
Une base claire pour les consignes précises, le chat multilingue et Apache-2.0.
Son comportement généraliste peut sembler moins littéraire ou moins proactif qu’un tune RP.
Ouvrir la model card ↗Tune RP communautaire
À tester si la prose, l’initiative et un system prompt souple comptent le plus.
Ce modèle a son propre template et ses conseils de sampling. Les éloges cités ne sont pas un benchmark.
Ouvrir la model card ↗Tune RP basé sur Mistral Small 3.2
Un candidat pour la voix des personnages, les groupes et le développement des scènes.
Sa card mentionne des erreurs occasionnelles de physique ou de causalité. La variante Heretic est distincte.
Ouvrir la model card ↗LoRA fusionné orienté roleplay
Conçu pour la narration immersive, une voix marquée et le mouvement de la scène.
La card signale des répétitions en longue génération, la prise de contrôle du personnage utilisateur et un format multi-personnage moins strict.
Ouvrir la model card ↗Tune RP avec fichiers GGUF
Pratique si votre stack local utilise déjà llama.cpp ou GGUF et si vous voulez choisir la taille du fichier.
Q4, Q6 et Q8 échangent mémoire, vitesse et fidélité. Ce n’est pas une nouvelle version officielle.
Ouvrir la model card ↗GRILLE DE DÉCISION
Notez les dimensions qui changent vos sessions. Un beau premier tour qui oublie un personnage secondaire à 16k peut être moins utile qu’un modèle plus sobre mais stable.
| Critère | 3.2 officiel | RP communautaire | Usage conseillé |
|---|---|---|---|
| Cohérence du personnage | Bonne base de suivi des consignes | Voix souvent plus forte, à vérifier entre 8 et 16k | Fiches longues |
| Prose et initiative | Directe et contrôlée | Magidonia, Cydonia et Umbra visent plus d’élan créatif | Scènes littéraires |
| Répétitions | La 3.2 annonce deux fois moins de générations infinies que la 3.1 | Dépend du tune, de la quantification et du sampler | Longues sorties |
| Contexte | La famille 3.2 annonce une capacité 128k | La KV cache pratique dépend du backend et de la quantification | Beaucoup de lore |
| Matériel | Environ 55GB de GPU en BF16/FP16 | GGUF de 13.6GB Q4_K_S à 25.2GB Q8_0 | Inférence locale |
| Licence et fraîcheur | Apache 2.0 et ID officiel clair | Vérifier card, base, date et variante | Partager ou déployer |
Score = 0,30 × adéquation à la fiche + 0,20 × voix + 0,20 × cohérence + 0,15 × contexte + 0,10 × matériel + 0,05 × confiance dans la licence. Changez les poids selon le cas.
TEST REPRODUCTIBLE
Ne comparez pas un base model et un tune RP avec des prompts différents. Gardez personnage, scène, contexte et budget de sortie identiques. Archivez prompt et quantification avec chaque résultat.
Donnez la même fiche, le même décor et la même action initiale. Vérifiez le vocabulaire, le point de vue, l’initiative et l’agence du personnage utilisateur.
Ajoutez un petit fait, une émotion nouvelle et un second personnage. Repérez les oublis, les répétitions, les changements de ton et les actions non demandées.
Notez cohérence, prose, agence, répétition et latence de 1 à 5. Gardez temperature, top_p, contexte, quantification et backend.
Le choix final doit convenir à la fiche et à la machine. Essayez un autre template ou une autre quantification avant de supprimer un candidat.

VÉRIFICATION LOCALE
Une réponse faible peut venir d’une couche avant les poids. Confirmez ID, format et chat template avant de modifier la génération.
3.2, 3.1, base, instruct, Magidonia, Cydonia et Umbra sont des artefacts distincts. « Mistral 24B » ne suffit pas.
La card 3.2 indique environ 55GB de GPU pour BF16/FP16. Les GGUF changent de taille et il faut de la marge pour la KV cache et le contexte.
Les cards Mistral indiquent le tokenizer et le format de chat Mistral. Si `<s>` ou des marqueurs apparaissent, retirez le double formatage.
La card officielle conseille une température basse en usage général. Un tune RP peut différer. Gardez le prompt fixe et changez une valeur.
TABBIT COMME BUREAU DE RECHERCHE
Tabbit n’exécute pas Mistral 24B et ne remplace pas votre frontend RP local. Lors de la vérification, son répertoire public ne listait pas Mistral. Utilisez-le pour réunir cards, quantifications, notes Reddit et résultats.
Gardez IDs, licences et dates dans des onglets voisins. Séparez la preuve d’une préférence personnelle.
Ajoutez une card, une capture ou une note locale à votre question et demandez une liste qui conserve les IDs et marque les inconnues.
Tabbit compare les réponses de plusieurs modèles visibles et résume les sources. Le sélecteur change, vérifiez-le après installation.


Bureau des modèles
Les ID restent visibles, les sources restent proches. Le navigateur devient votre carnet.
Les cards ci-dessus consignent ce qui a été vérifié, sans promettre que chaque endpoint ou modèle restera disponible.
FAQ
Les sources ne désignent pas un gagnant universel. Commencez par Small 3.2, puis testez Magidonia, Cydonia, Umbra ou Roleplay V3 avec votre fiche.
Les résultats l’identifient comme un upscale 36B et comme un modèle communautaire 31B. Il peut venir de Mistral Small 24B, mais ce n’est pas un checkpoint 24B.
Les cards communautaires rapportent une bonne cohérence pour Magidonia et Cydonia, tandis qu’Umbra vise la voix et l’élan de scène. Ce sont des retours qualitatifs à tester.
Prenez la meilleure qualité qui tient avec votre contexte. La page GGUF de Roleplay V3 liste Q4_K_S 13.6GB, Q4_K_M 14.4GB, Q6_K 19.4GB et Q8_0 25.2GB.
Ne le supposez pas. Mistral n’apparaissait pas dans le répertoire public de Tabbit lors de la vérification. Tabbit est présenté ici pour rassembler et comparer les sources.
Conservez checkpoint, quantification, prompt et résultat ensemble. Vous comparerez mieux les nouvelles versions et trouverez plus vite la cause d’une mauvaise session.
Disponible sur macOS et Windows. La disponibilité des modèles peut changer.