Le modèle de ce guide
`TheDrummer/Skyfall-31B-v4.2` est le dépôt safetensors. La fiche indique TheDrummer comme auteur et Mistral v7 Tekken comme template.
SKYFALL 31B × SILLYTAVERN
Skyfall 31B désigne plusieurs versions et formats. Ce guide concerne TheDrummer/Skyfall-31B-v4.2. Vérifiez l’ID, le modèle de base, le template Mistral v7 et la quantification avant de modifier une fiche personnage.

VÉRIFIER L’ID DU DÉPÔT
Notez le nom complet du dépôt pour distinguer v4.2, v4.1, les anciens Skyfall et les résultats homonymes.
`TheDrummer/Skyfall-31B-v4.2` est le dépôt safetensors. La fiche indique TheDrummer comme auteur et Mistral v7 Tekken comme template.
Les métadonnées indiquent `mistralai/Magistral-Small-2509` comme base. Ne le remplacez pas par une version Mistral Small ressemblante.
L’API HF indique 31 352 980 480 paramètres BF16, une architecture Mistral et une position maximale de 131 072. Cela ne garantit pas le contexte de votre runtime.
Les métadonnées API consultées n’affichaient pas de licence. Lisez la fiche et les conditions upstream avant redistribution ou usage commercial.
QUANTIFICATION ET MATÉRIEL
Le dépôt officiel est volumineux. GGUF propose plusieurs compromis. La taille filtre les options, mais ne donne pas la VRAM finale.
L’arbre GGUF indique environ 18,98 Go pour Q4_K_M. Gardez de la marge pour le runtime, le contexte et le système. 24 Go de GPU ne suffisent pas toujours pour un chargement confortable.
Q5_K_M fait environ 22,25 Go, Q6_K 25,73 Go et Q8_0 33,32 Go. Le offload CPU ou RAM peut fonctionner, mais ralentit fortement.
Q2_K fait environ 11,73 Go et Q3_K_M 15,20 Go. Après un changement, testez la même scène courte.
La fiche GGUF documente llama.cpp et Ollama. Téléchargez le fichier exact, démarrez le backend, puis copiez endpoint et model ID dans SillyTavern.
CONFIGURATION RP SILLYTAVERN
Skyfall v4.2 utilise un template Mistral v7 Tekken personnalisé. Confiez le formatage à une seule couche et testez deux tours.
Laissez le tokenizer ou le backend appliquer le template si possible. Si SillyTavern enveloppe aussi le prompt, cherchez les role markers doublés.
Le template cherche `/think` dans le message système et peut ajouter `[THINK]...[/THINK]`. Testez-le volontairement, sans le glisser par erreur dans la carte.
Pour un premier RP, essayez temperature 0.7, top_p 0.9 et une longueur maximale modérée. Ne changez qu’une valeur à la fois.
Indiquez quelle voix le modèle contrôle. Gardez les exemples courts et retirez les consignes contradictoires.
La communauté rapporte des dialogues naturels, une bonne cohérence de personnage et le respect du ton. Elle mentionne aussi la verbosité, une narration inégale, le modèle qui parle pour l’utilisateur ou répète après un swipe. Ce ne sont pas des benchmarks contrôlés.
SYMPTÔME → VÉRIFICATION → SOLUTION
Répétez un prompt court et ne changez qu’un élément pour distinguer template, modèle et matériel.
| Symptôme | Vérifier | Étape suivante |
|---|---|---|
| Réponse vide ou marqueurs visibles | Endpoint, propriétaire du template Mistral, `/think`, stop strings. | Envoyez une ligne, gardez un seul propriétaire de template et retirez les marqueurs. |
| Le modèle parle pour {{user}} | Exemples de carte, system prompt et dernier assistant. | Définissez la limite de voix, raccourcissez les exemples et testez deux choix. |
| Réponses longues et répétitives | Contexte, lore en double, max tokens et sampler. | Réduisez la carte, le budget, puis modifiez un sampler à la fois. |
| Lent ou instable | Taille du fichier, offload, marge RAM/VRAM et contexte. | Essayez une quantification plus petite ou moins de contexte, puis comparez tokens/sec. |
| Comportement différent de la fiche | v4.2/v4.1, safetensors/GGUF et model ID complet. | Recopiez l’ID et suivez la fiche du fichier précis. |
TABBIT COMME BUREAU DE RECHERCHE
Tabbit n’exécute pas Skyfall et ne remplace pas SillyTavern. Il rassemble cartes, arbre GGUF et discussions.
Placez la fiche officielle, l’arbre GGUF et la documentation SillyTavern côte à côte. Demandez les IDs, tailles et instructions uniquement.
Référencez une page, une capture ou une note locale avec @ et séparez faits confirmés et questions ouvertes.
Comparez les explications dans le chat multimodèle. Tabbit organise les preuves, le backend local exécute Skyfall.




CHOISIR LA BONNE SURFACE
Les rôles diffèrent. Gardez les contrôles de génération dans SillyTavern et réduisez les changements d’onglets avec Tabbit.
| SillyTavern + backend | Tabbit | |
|---|---|---|
| Exécuter Skyfall en local | Oui, avec un backend compatible | Non garanti |
| Cartes et samplers | Contrôles détaillés | Notes de référence |
| Lire cartes et quantifications | Changer d’onglet ou d’app | @ pages, fichiers et captures |
| Comparer les explications | Changer preset ou endpoint | Comparer les modèles disponibles |
| Diagnostic matériel | Voir VRAM, offload, vitesse | Rassembler les preuves |
FAQ
TheDrummer/Skyfall-31B-v4.2. v4.1 et les autres projets Skyfall peuvent utiliser un template différent.
Les métadonnées de la fiche indiquent mistralai/Magistral-Small-2509. Utilisez l’ID complet.
Q4_K_M, environ 18,98 Go dans l’arbre GGUF officiel, est un bon départ. Vérifiez la marge du runtime et essayez Q3 ou Q5 si besoin.
La fiche indique Mistral v7 Tekken. Le template personnalisé vérifie aussi /think dans le system prompt.
Aucune promesse ici. Tabbit rassemble cartes, fichiers et comparaisons. Exécutez le modèle dans un backend local compatible puis connectez-le à SillyTavern.
Confirmez v4.2, choisissez une quantification, donnez au format Mistral un seul responsable et testez une scène courte. Utilisez Tabbit quand les preuves sont dispersées.
Disponible sur macOS et Windows. La liste de modèles peut changer.