Utilisez cet ID exact
Saisissez gemini-2.5-flash-lite. L’ID preview gemini-2.5-flash-lite-preview-09-2025 est arrêté.
GEMINI 2.5 FLASH-LITE × SILLYTAVERN
SillyTavern peut se connecter à Gemini 2.5 Flash-Lite via Google AI Studio. Les problèmes viennent souvent de détails précis : provider, nom exact, clé, contexte envoyé et sens réel d’un 429 ou d’une réponse vide.

VÉRIFIER LE MODÈLE
Google décrit Gemini 2.5 Flash-Lite comme un modèle stable pour les tâches multimodales légères et fréquentes. Il accepte texte, images, vidéo, audio et PDF, puis renvoie du texte.
Saisissez gemini-2.5-flash-lite. L’ID preview gemini-2.5-flash-lite-preview-09-2025 est arrêté.
La limite documentée est de 1 048 576 tokens en entrée et 65 536 en sortie. Le RPM, TPM et RPD dépendent du projet et du niveau Google.
Le modèle prend en charge thinking, function calling, sorties structurées, URL context, Search grounding, exécution de code, cache et recherche de fichiers.
Google AI Studio propose un niveau gratuit avec accès et tokens limités. Vérifiez le quota actuel avant une session intensive.
CONFIGURATION SILLYTAVERN
Le guide Google de SillyTavern utilise Chat Completion. Créez la clé dans Google AI Studio, puis laissez SillyTavern charger les modèles. Un test court sépare clé, quota et format.
Ouvrez la page API key, connectez-vous, choisissez Get API Key, acceptez les conditions et copiez la clé. Gardez-la secrète, loin des cartes de personnage et captures publiques.
Dans SillyTavern, ouvrez API Connections. Choisissez Chat Completion puis Google AI Studio. Collez la clé et cliquez sur Connect.
Sélectionnez gemini-2.5-flash-lite dans la liste. Si vous le saisissez, utilisez l’ID exact. Un preview arrêté ne se corrige pas avec temperature.
Envoyez un message bref avec une carte compacte. Gardez streaming identique et notez modèle, provider, contexte et état de réponse.
Ajoutez ensuite system prompt, format instruct et lore. Si des marqueurs apparaissent dans la réponse, vérifiez d’abord la template.
Google mesure les limites par RPM, TPM et RPD et les applique au projet, pas seulement à la clé. Les modèles preview peuvent être plus limités.
LA PLACE DE TABBIT
Tabbit n’est ni un frontend SillyTavern, ni un runner Gemma local, ni un gestionnaire de clés Google AI Studio. Il sert au contexte autour de la session : wikis, références, PDF, captures et comparaison de modèles.
Gardez vos notes canon, votre wiki et vos documents dans des onglets visibles. Tabbit peut les résumer dans son panneau latéral.
Utilisez @ pour ajouter une page, une capture ou un fichier au prompt et demander une vérification de continuité.
Le snapshot de production international actuel liste et active gemini-2.5-flash-lite, mais le compte, l’édition, le quota et le déploiement futur peuvent varier : vérifiez le sélecteur de modèles en direct de SillyTavern. Tabbit n’accepte toujours ni provider SillyTavern ni clé Google AI Studio, et ne peut pas remplacer SillyTavern pour cette connexion.

CHOISIR LA BONNE SURFACE
Utilisez SillyTavern pour les cartes, le format et la génération. Utilisez Tabbit quand les références sont réparties entre pages et fichiers.
| Besoin | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Endpoint Gemini 2.5 Flash-Lite | Connexion avec l’ID exact, puis vérifier le sélecteur en direct | Pas une connexion Tabbit, gardez-la dans SillyTavern |
| Clé API et quota | Gérés dans AI Studio | Aucun champ pour cette clé |
| Cartes et lore | Contrôles RP détaillés | Référencer un wiki ou fichier |
| Contexte web | Coller ou intégrer | @ onglets, captures et fichiers |
| Actions Agent | Dépend de la configuration ST | Mode Agent du navigateur |
Sources officielles
Google AI Studio propose un niveau gratuit avec accès et tokens limités. Vérifiez le quota actuel avant une session intensive.

LIRE LES SOURCES
FAQ
Utilisez gemini-2.5-flash-lite pour le modèle stable. gemini-2.5-flash-lite-preview-09-2025 est arrêté.
Ouvrez API Connections, choisissez Chat Completion, Google AI Studio, collez la clé puis connectez.
Une limite de débit ou de dépense a été dépassée. Vérifiez RPM, TPM et RPD du projet dans AI Studio, puis attendez ou réduisez fréquence, contexte et sortie.
Vérifiez console et détails de réponse, puis testez streaming désactivé avec un prompt court et l’ID stable. Examinez aussi le format, les retours de sécurité et finish details.
La limite d’entrée documentée est de 1 048 576 tokens et celle de sortie de 65 536 tokens. Cela ne garantit pas la récupération uniforme de tous les détails d’un long RP.
Google indique que le modèle le prend en charge. Le contrôle dépend du connecteur SillyTavern. Si l’option n’existe pas, n’inventez pas de paramètre.
AI Studio possède un niveau gratuit limité. Les quotas dépendent du projet et du niveau. Consultez la page de prix actuelle.
Non. Tabbit n’accepte ni provider SillyTavern ni clé Google AI Studio. Utilisez-le pour le contexte web et ses modèles affichés.
Connectez Gemini API dans SillyTavern. Utilisez Tabbit quand le prompt dépend de pages, fichiers et actions du navigateur.
Disponible sur macOS et Windows. Le catalogue et les providers peuvent évoluer.