Gemma 4 uncensored × SillyTavern

Gemma 4 uncensored dans SillyTavern

Uncensored n’est pas une variante officielle de Google. Il peut désigner un fine-tune communautaire, un checkpoint modifié, une étiquette de fournisseur ou simplement un retour de roleplay. Vérifiez la fiche, le modèle de base, la licence, le template et la politique du fournisseur avant d’attribuer un refus au modèle.

Model card Google
Vérifier les faits officiels
Navigateur Tabbit sur ordinateur avec onglets verticaux, champ central et panneau de chat à droite.

Nom et matériel

26B A4B est un MoE, pas seulement un chiffre

Google utilise le nom Gemma 4 26B A4B. Le model card indique 25,2 milliards de paramètres, 3,8 milliards actifs, 30 couches, les images et un contexte de 256K. Les suffixes IT, Q4, Q5 et les noms de créateurs sont des labels de distribution GGUF.

01

Utiliser le bon identifiant

Le checkpoint instruction de Hugging Face est `google/gemma-4-26B-A4B-it`. Q4, Q5 et Q6 désignent des quantifications, pas de nouvelles familles Google.

02

Compter contexte et runtime

Le nombre de paramètres actifs aide à comprendre la vitesse, mais tous les fichiers ne deviennent pas des modèles de 4 Go. Poids, buffers, encodeur visuel d’environ 550M, KV cache et contexte comptent.

03

Ne pas copier la recette 31B

31B est un modèle dense d’environ 30,7 milliards de paramètres. 26B A4B route les tokens vers des experts. Une estimation mémoire prévue pour 31B peut être trompeuse.

Ordre de vérification

Vérifier l’affirmation avant la carte

Un ordre simple sépare un template incorrect, un sampler instable, un dérivé communautaire et une carte de personnage mal réglée.

  1. 01

    1. Confirmer le checkpoint et l’auteur

    Conservez l’ID complet, le checkpoint de base, la variante, le fichier quantifié et le lien de la fiche. Un nom uncensored ne prouve pas qu’il s’agit d’une variante officielle.

  2. 02

    2. Choisir le mode API

    KoboldCpp, llama.cpp, LM Studio et les fournisseurs compatibles OpenAI exposent des endpoints différents. Commencez par Chat Completions quand il est disponible.

  3. 03

    3. Aligner tokenizer et template

    Le format Google utilise `system`, `user`, `model`, `<|turn>` et `<turn|>`. Prenez le template Gemma 4 ou Gemini fourni par le backend, pas un ancien template Gemma 3.

  4. 04

    4. Tester le thinking

    Google documente `<|think|>` au début du system prompt pour activer la réflexion. Faites un test court, puis ajoutez la carte et le preset. Dans l’historique normal, gardez seulement la réponse finale.

Les discussions communautaires citent SillyTavern 1.17, `--jinja` avec KoboldCpp, le tokenizer Gemma4/Gemini et `<|think|>`. Ce ne sont pas des réglages Google universels.

Quand la sortie déraille

Réparer la couche en cause

CASE 01

Les marqueurs deviennent du texte

Vérifiez tokenizer, template et mode de génération du backend. Si le serveur applique déjà le template, les tokens ajoutés à la main peuvent apparaître tels quels. Comparez thinking activé et désactivé.

CASE 02

La réflexion est irrégulière

Vérifiez la compatibilité de SillyTavern et du loader avec Gemma 4. `--jinja` ou `<|think|>` peuvent aider selon le serveur, mais ne combinez pas les solutions sans test.

CASE 03

Le personnage répète ou oublie

Réduisez le contexte dupliqué avant de changer la température. Vérifiez la limite et la carte, puis testez temperature 1.0, top-p 0.95 et top-k 64.

Parcours navigateur

Garder la wiki ouverte et demander à côté

Tabbit n’est ni un runner GGUF local ni un gestionnaire de cartes SillyTavern. Il sert à garder une wiki, des notes ou un fil de dépannage visibles pendant une discussion avec un modèle disponible dans le navigateur.

  1. 1

    Installer Tabbit

    Téléchargez le navigateur basé sur Chromium pour macOS ou Windows. Aucun fichier Gemma local, aucune clé fournisseur et aucun serveur SillyTavern ne sont requis.

  2. 2

    Choisir un modèle affiché

    Ouvrez le sélecteur après l’installation. Le code actuel liste GPT-5.4, Gemini-3.1-Pro, Claude-Sonnet-4.6 et DeepSeek-V4-Flash. Gemma 4 n’est pas dans le mapping actuel, donc cette page ne promet pas son exécution.

  3. 3

    Référencer la source

    Laissez la wiki ou les notes dans un onglet. Avec `@`, référencez une page, une capture ou un fichier pour demander un plan de scène, une vérification de cohérence ou un résumé.

Sélecteur de modèles Tabbit affichant GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash et Claude-Sonnet-4.6. Gemma 4 n’est pas visible.

Choisir le client

SillyTavern pour la carte, Tabbit pour la source

Les deux outils répondent à des blocages différents. Gardez les contrôles RP spécialisés et utilisez le navigateur lorsque le contexte est réparti entre pages et fichiers.

SillyTavernTabbit
Cartes et lorebooksFlux principalRéférencer la source
Checkpoint Gemma 4 localBackend à fournirChoisir dans la liste
Template et samplerContrôle détailléGéré par le modèle
Contexte webColler ou extensionsRéférencer onglet ou fichier avec @
Première réponse utileEndpoint + template + presetInstaller + choisir
Sélecteur de modèles Tabbit affichant GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash et Claude-Sonnet-4.6. Gemma 4 n’est pas visible.

Référencer la source

Laissez la wiki ou les notes dans un onglet. Avec `@`, référencez une page, une capture ou un fichier pour demander un plan de scène, une vérification de cohérence ou un résumé.

Sélecteur de modèles Tabbit affichant GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash et Claude-Sonnet-4.6. Gemma 4 n’est pas visible.

Contexte web

Référencer onglet ou fichier avec @

FAQ

Gemma 4 uncensored et SillyTavern

Quel est le nom officiel de Gemma 4 26B ?+

Google l’appelle Gemma 4 26B A4B. Le checkpoint instruction de Hugging Face est `google/gemma-4-26B-A4B-it`; les distributeurs peuvent ajouter leurs suffixes.

26B A4B est-il identique à 31B ?+

Non. 26B A4B est un MoE avec 25,2 milliards au total et environ 3,8 milliards actifs. 31B est dense avec environ 30,7 milliards.

Combien de VRAM faut-il ?+

Il n’existe pas de chiffre unique. Quantification, KV cache, contexte, buffers et encodeur visuel changent le besoin. Mesurez le fichier réel avec votre contexte cible.

Pourquoi `<|think|>` apparaît-il dans la réponse ?+

Le tokenizer ou le template peut différer du backend, ou le serveur peut exposer le token comme du texte. Vérifiez le format et thinking avant le sampling.

Tabbit peut-il exécuter Gemma 4 26B ?+

Ne le supposez pas. Le mapping actuel de Tabbit ne contient pas Gemma 4. Utilisez uniquement un modèle visible dans le sélecteur.

Vérifier le modèle avant le preset

Pour un modèle communautaire uncensored, vérifiez checkpoint, fiche, licence, mémoire, tokenizer et template dans cet ordre. Pour parler à côté d’une wiki, installez Tabbit et consultez le sélecteur actuel.

Disponible pour macOS et Windows. La disponibilité peut changer.

© 2026 Tabbit Browser. Le navigateur natif IA qui comprend votre contexte.