Utiliser le bon identifiant
Le checkpoint instruction de Hugging Face est `google/gemma-4-26B-A4B-it`. Q4, Q5 et Q6 désignent des quantifications, pas de nouvelles familles Google.
Gemma 4 uncensored × SillyTavern
Uncensored n’est pas une variante officielle de Google. Il peut désigner un fine-tune communautaire, un checkpoint modifié, une étiquette de fournisseur ou simplement un retour de roleplay. Vérifiez la fiche, le modèle de base, la licence, le template et la politique du fournisseur avant d’attribuer un refus au modèle.
Vérifier les faits officiels ↗
Nom et matériel
Google utilise le nom Gemma 4 26B A4B. Le model card indique 25,2 milliards de paramètres, 3,8 milliards actifs, 30 couches, les images et un contexte de 256K. Les suffixes IT, Q4, Q5 et les noms de créateurs sont des labels de distribution GGUF.
Le checkpoint instruction de Hugging Face est `google/gemma-4-26B-A4B-it`. Q4, Q5 et Q6 désignent des quantifications, pas de nouvelles familles Google.
Le nombre de paramètres actifs aide à comprendre la vitesse, mais tous les fichiers ne deviennent pas des modèles de 4 Go. Poids, buffers, encodeur visuel d’environ 550M, KV cache et contexte comptent.
31B est un modèle dense d’environ 30,7 milliards de paramètres. 26B A4B route les tokens vers des experts. Une estimation mémoire prévue pour 31B peut être trompeuse.
Ordre de vérification
Un ordre simple sépare un template incorrect, un sampler instable, un dérivé communautaire et une carte de personnage mal réglée.
Conservez l’ID complet, le checkpoint de base, la variante, le fichier quantifié et le lien de la fiche. Un nom uncensored ne prouve pas qu’il s’agit d’une variante officielle.
KoboldCpp, llama.cpp, LM Studio et les fournisseurs compatibles OpenAI exposent des endpoints différents. Commencez par Chat Completions quand il est disponible.
Le format Google utilise `system`, `user`, `model`, `<|turn>` et `<turn|>`. Prenez le template Gemma 4 ou Gemini fourni par le backend, pas un ancien template Gemma 3.
Google documente `<|think|>` au début du system prompt pour activer la réflexion. Faites un test court, puis ajoutez la carte et le preset. Dans l’historique normal, gardez seulement la réponse finale.
Les discussions communautaires citent SillyTavern 1.17, `--jinja` avec KoboldCpp, le tokenizer Gemma4/Gemini et `<|think|>`. Ce ne sont pas des réglages Google universels.
Quand la sortie déraille
Vérifiez tokenizer, template et mode de génération du backend. Si le serveur applique déjà le template, les tokens ajoutés à la main peuvent apparaître tels quels. Comparez thinking activé et désactivé.
Vérifiez la compatibilité de SillyTavern et du loader avec Gemma 4. `--jinja` ou `<|think|>` peuvent aider selon le serveur, mais ne combinez pas les solutions sans test.
Réduisez le contexte dupliqué avant de changer la température. Vérifiez la limite et la carte, puis testez temperature 1.0, top-p 0.95 et top-k 64.
Parcours navigateur
Tabbit n’est ni un runner GGUF local ni un gestionnaire de cartes SillyTavern. Il sert à garder une wiki, des notes ou un fil de dépannage visibles pendant une discussion avec un modèle disponible dans le navigateur.
Téléchargez le navigateur basé sur Chromium pour macOS ou Windows. Aucun fichier Gemma local, aucune clé fournisseur et aucun serveur SillyTavern ne sont requis.
Ouvrez le sélecteur après l’installation. Le code actuel liste GPT-5.4, Gemini-3.1-Pro, Claude-Sonnet-4.6 et DeepSeek-V4-Flash. Gemma 4 n’est pas dans le mapping actuel, donc cette page ne promet pas son exécution.
Laissez la wiki ou les notes dans un onglet. Avec `@`, référencez une page, une capture ou un fichier pour demander un plan de scène, une vérification de cohérence ou un résumé.

Choisir le client
Les deux outils répondent à des blocages différents. Gardez les contrôles RP spécialisés et utilisez le navigateur lorsque le contexte est réparti entre pages et fichiers.
| SillyTavern | Tabbit | |
|---|---|---|
| Cartes et lorebooks | Flux principal | Référencer la source |
| Checkpoint Gemma 4 local | Backend à fournir | Choisir dans la liste |
| Template et sampler | Contrôle détaillé | Géré par le modèle |
| Contexte web | Coller ou extensions | Référencer onglet ou fichier avec @ |
| Première réponse utile | Endpoint + template + preset | Installer + choisir |

Laissez la wiki ou les notes dans un onglet. Avec `@`, référencez une page, une capture ou un fichier pour demander un plan de scène, une vérification de cohérence ou un résumé.

Référencer onglet ou fichier avec @
FAQ
Google l’appelle Gemma 4 26B A4B. Le checkpoint instruction de Hugging Face est `google/gemma-4-26B-A4B-it`; les distributeurs peuvent ajouter leurs suffixes.
Non. 26B A4B est un MoE avec 25,2 milliards au total et environ 3,8 milliards actifs. 31B est dense avec environ 30,7 milliards.
Il n’existe pas de chiffre unique. Quantification, KV cache, contexte, buffers et encodeur visuel changent le besoin. Mesurez le fichier réel avec votre contexte cible.
Le tokenizer ou le template peut différer du backend, ou le serveur peut exposer le token comme du texte. Vérifiez le format et thinking avant le sampling.
Ne le supposez pas. Le mapping actuel de Tabbit ne contient pas Gemma 4. Utilisez uniquement un modèle visible dans le sélecteur.
Pour un modèle communautaire uncensored, vérifiez checkpoint, fiche, licence, mémoire, tokenizer et template dans cet ordre. Pour parler à côté d’une wiki, installez Tabbit et consultez le sélecteur actuel.
Disponible pour macOS et Windows. La disponibilité peut changer.