ID stable
Utilisez `gemini-2.5-flash-lite`. Google indique que `gemini-2.5-flash-lite-preview-09-2025` est arrêté. Changer la température ne répare pas un ID retiré.
GEMINI API × SILLYTAVERN
Utilisez le modèle stable Gemini 2.5 Flash-Lite dans SillyTavern via Google AI Studio. Vérifiez le provider, la clé, l’ID exact, la première requête, thinking et les erreurs qui font paraître une connexion valide défaillante.

VÉRIFIER LE MODÈLE
Google présente Gemini 2.5 Flash-Lite comme un modèle multimodal stable et rapide. Il accepte le texte, les images, la vidéo, l’audio et les PDF, puis renvoie du texte. Une grande fenêtre de contexte ne supprime pas les quotas du projet ni les contrôles du provider.
Utilisez `gemini-2.5-flash-lite`. Google indique que `gemini-2.5-flash-lite-preview-09-2025` est arrêté. Changer la température ne répare pas un ID retiré.
La page du modèle indique 1 048 576 tokens en entrée et 65 536 en sortie. Les limites RPM, TPM et RPD réelles dépendent du projet et du niveau d’utilisation.
Google indique thinking, les appels de fonctions, la sortie structurée, URL context, Search grounding, l’exécution de code, le cache et la recherche de fichiers. SillyTavern peut exposer moins de réglages.
L’accès gratuit et payant ont des limites différentes. Consultez l’usage et les prix dans AI Studio avant une longue session RP. Gratuit ne veut pas dire illimité.

CONFIGURATION SILLYTAVERN
Le guide officiel de SillyTavern place Google AI Studio sous Chat Completion. Gardez la première requête courte. Ajoutez ensuite le format du personnage, le lore et le contexte long, un changement à la fois.
Ouvrez les clés API Google AI Studio, connectez-vous, choisissez Get API Key, acceptez les conditions, créez la clé et copiez-la. Traitez-la comme un mot de passe. Ne la mettez pas dans une carte de personnage ou une capture publique.
Dans SillyTavern, ouvrez API Connections. Sélectionnez Chat Completion puis Google AI Studio, collez la clé dans API Key et cliquez sur Connect. Vertex AI est un autre provider avec une autre authentification.
Sélectionnez `gemini-2.5-flash-lite` dans la liste renvoyée. En saisie manuelle, utilisez l’ID stable exact. N’utilisez pas l’alias preview arrêté.
Utilisez un message court et une carte compacte. Gardez streaming identique pendant le test et notez provider, modèle, taille du contexte et état de la réponse.
Après le texte simple, ajoutez l’instruction système, le format et le lore. Si des marqueurs apparaissent dans la réponse, vérifiez le template du connecteur avant les samplers.
Google applique les limites RPM, TPM et RPD au projet. Une autre clé du même projet ne crée pas de quota supplémentaire.
FORME DE LA REQUÊTE
L’exemple REST officiel de Google utilise un en-tête de clé et du JSON. SillyTavern construit sa requête provider, donc ceci explique les concepts API et ne constitue pas une liste de champs à inventer.
POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
Content-Type: application/json
Body: {
"model": "gemini-2.5-flash-lite",
"input": "Répondez en une phrase courte."
}Forme REST minimale de la documentation Google
Lorsque le connecteur le permet, séparez l’instruction système du tour utilisateur. Ne supposez pas que les champs Chat Completion correspondent exactement au JSON REST de Google.
Google indique la prise en charge de thinking et une sortie maximale de 65 536 tokens. Utilisez uniquement les réglages documentés par le connecteur SillyTavern actuel.
Google documente le streaming avec `stream: true` et SSE. En cas de réponse vide, refaites le test court sans streaming pour isoler un souci d’affichage ou de parsing.
DÉPANNAGE
Commencez par le code, le provider et le modèle de la requête. Ne changez qu’une variable à la fois et protégez la clé.
| Signal | À vérifier | Étape suivante |
|---|---|---|
| 400 INVALID_ARGUMENT | Nom du modèle, JSON, ordre des messages et réglages non pris en charge. | Revenez au prompt minimal. Retirez un réglage optionnel puis réintroduisez-le seul. |
| 401 UNAUTHENTICATED | Valeur de clé, en-tête, espaces et provider sélectionné. | Recopiez ou recréez la clé dans AI Studio, reconnectez Google AI Studio et ne mélangez pas les identifiants Vertex. |
| 403 PERMISSION_DENIED | Accès du projet, état de l’API, région ou réponse de policy. | Vérifiez le projet Google et l’état AI Studio. Ne contournez aucun contrôle de sécurité. |
| 404 NOT_FOUND | ID exact du modèle et endpoint du provider. | Utilisez `gemini-2.5-flash-lite`, retirez l’alias preview arrêté et actualisez la liste. |
| 429 RESOURCE_EXHAUSTED | RPM, TPM, RPD et niveau de facturation du projet dans AI Studio. | Attendez, réduisez fréquence, contexte ou sortie et consultez les quotas. Une nouvelle clé du même projet peut ne rien changer. |
| 200 mais vide | Parser streaming, détails de fin, retour sécurité, format et champ de texte. | Testez un prompt court sans streaming, puis vérifiez console et réponse avant de modifier la carte. |
TABBIT POUR LE CONTEXTE
Tabbit n’exécute pas votre provider SillyTavern et n’accepte pas votre clé Google AI Studio. Il sert aux pages sources, références de personnages, captures, PDF et tâches du navigateur.
Gardez une wiki canon, une documentation ou une note de décor dans un onglet visible. Tabbit peut résumer la page dans son panneau latéral.
Référencez une page, une capture ou un fichier local avec @ pour demander un résumé ou vérifier la continuité, sans coller chaque paragraphe.
L’instantané de production international actuel liste et active `gemini-2.5-flash-lite`. Le compte, l’édition, le quota et les futurs déploiements peuvent différer : utilisez le picker en direct. Tabbit n’est pas la connexion SillyTavern.

DEUX TÂCHES DIFFÉRENTES
SillyTavern gère la carte et la requête provider. Tabbit gère le contexte du navigateur et son assistant natif. Cette limite évite de transformer un champ inexistant en fausse étape.

| Besoin | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Clé Gemini | La créer dans AI Studio et la coller dans le provider Google AI Studio. | Aucun champ pour cette clé. |
| ID stable | Choisir `gemini-2.5-flash-lite` dans la liste active. | Utiliser les modèles réellement listés par Tabbit. |
| Cartes et lore | Utiliser contrôles RP, templates et contexte. | Référencer wiki, note ou fichier depuis un onglet. |
| Recherche web | Ajouter du contexte avec votre flux ST. | Utiliser @ avec pages, captures et fichiers. |
| Actions Agent | Dépendent de votre configuration SillyTavern. | Utiliser le mode Agent pour les tâches web compatibles. |
RÉFÉRENCES OFFICIELLES
FAQ
Utilisez `gemini-2.5-flash-lite`. Google indique que `gemini-2.5-flash-lite-preview-09-2025` est arrêté.
Ouvrez API Connections, choisissez Chat Completion puis Google AI Studio, collez la clé AI Studio et connectez. Vertex AI est un autre provider.
Google publie un guide de compatibilité, mais le comportement du provider SillyTavern peut différer. Commencez par Google AI Studio documenté et utilisez la compatibilité seulement si les documents et le connecteur actuels la prennent en charge.
Les limites RPM, TPM et RPD de Google sont liées au projet. Vérifiez l’usage et le niveau dans AI Studio, attendez ou réduisez fréquence, contexte et sortie.
Testez un prompt court sans streaming, puis vérifiez console, fin, sécurité et format du connecteur. Ne changez pas d’abord la carte.
Google documente 1 048 576 tokens en entrée et 65 536 en sortie. Ce sont des plafonds, pas une garantie de récupérer tous les anciens détails de façon uniforme.
Google le liste comme compatible. Le connecteur actuel de SillyTavern peut exposer d’autres commandes. Si un champ n’est pas documenté, gardez la valeur par défaut.
Non. Tabbit n’accepte pas ce provider ni votre clé Google AI Studio. Gardez cette connexion dans SillyTavern.
Connectez Gemini 2.5 Flash-Lite dans SillyTavern. Utilisez Tabbit lorsque la conversation dépend de pages, fichiers ou actions du navigateur.
Disponible sur macOS et Windows. Les modèles et providers Tabbit peuvent changer.