ID estable
Usa `gemini-2.5-flash-lite`. Google marca `gemini-2.5-flash-lite-preview-09-2025` como cerrado. Cambiar la temperatura no arregla un ID retirado.
GEMINI API × SILLYTAVERN
Usa el modelo estable Gemini 2.5 Flash-Lite en SillyTavern mediante Google AI Studio. Comprueba el proveedor, la clave, el ID exacto, la primera petición, thinking y los errores que hacen que una conexión válida parezca rota.

COMPRUEBA EL MODELO
Google describe Gemini 2.5 Flash-Lite como un modelo multimodal estable y rápido. Acepta texto, imágenes, vídeo, audio y PDF, y devuelve texto. Un contexto grande no elimina las cuotas del proyecto ni las comprobaciones del proveedor.
Usa `gemini-2.5-flash-lite`. Google marca `gemini-2.5-flash-lite-preview-09-2025` como cerrado. Cambiar la temperatura no arregla un ID retirado.
La página del modelo indica 1.048.576 tokens de entrada y 65.536 de salida. Tus límites reales de RPM, TPM y RPD dependen del proyecto y nivel de uso.
Google indica soporte para thinking, llamadas a funciones, salida estructurada, URL context, Search grounding, ejecución de código, caché y búsqueda de archivos. SillyTavern puede mostrar menos controles.
El acceso gratuito y el de pago tienen límites distintos. Revisa uso y precios en AI Studio antes de planear una sesión larga. Gratis no significa ilimitado.

CONFIGURACIÓN DE SILLYTAVERN
La guía oficial de SillyTavern coloca Google AI Studio bajo Chat Completion. Mantén pequeña la primera petición. Después añade formato de personaje, lore y más contexto, un cambio cada vez.
Abre las claves API de Google AI Studio, inicia sesión, elige Get API Key, acepta los términos, crea la clave y cópiala. Guárdala como una contraseña. No la pongas en una tarjeta de personaje ni en una captura pública.
En SillyTavern abre API Connections. Selecciona Chat Completion, elige Google AI Studio, pega la clave en API Key y pulsa Connect. Vertex AI usa otro proveedor y otra autenticación.
Selecciona `gemini-2.5-flash-lite` en la lista devuelta. Si escribes el modelo a mano, usa el ID exacto y estable. No uses el alias de preview cerrado.
Usa un mensaje corto y una tarjeta compacta. Mantén streaming igual durante la prueba y anota proveedor, modelo, tamaño de contexto y estado de respuesta.
Cuando el texto simple funcione, añade la instrucción de sistema, el formato y el lore. Si aparecen marcadores en la respuesta, revisa la plantilla del conector antes de cambiar samplers.
Google aplica RPM, TPM y RPD al proyecto. Otra clave del mismo proyecto no crea una cuota nueva.
FORMA DE LA PETICIÓN
El ejemplo REST oficial de Google usa una cabecera de clave y JSON. SillyTavern construye su propia petición de proveedor, así que esto sirve para entender la API, no para inventar campos de la interfaz.
POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
Content-Type: application/json
Body: {
"model": "gemini-2.5-flash-lite",
"input": "Responde en una frase corta."
}Forma REST mínima de la documentación de Google
Cuando el conector lo permita, separa la instrucción de sistema del turno del usuario. No supongas que cada campo de Chat Completion coincide con el JSON REST de Google.
Google indica soporte para thinking y una salida máxima de 65.536 tokens. Usa solo los controles que el conector actual documente.
Google documenta streaming con `stream: true` y SSE. Si la respuesta queda vacía, repite la prueba corta con streaming desactivado para aislar un problema de pantalla o parseo.
SOLUCIÓN DE PROBLEMAS
Empieza por el código, proveedor y modelo de la petición. Cambia una variable cada vez y protege la clave.
| Señal | Comprueba primero | Siguiente paso |
|---|---|---|
| 400 INVALID_ARGUMENT | Nombre del modelo, JSON, orden de mensajes y ajustes no admitidos. | Vuelve al prompt mínimo. Quita un ajuste opcional y añádelo de nuevo después. |
| 401 UNAUTHENTICATED | Valor de la clave, cabecera, espacios y proveedor. | Copia o crea la clave de nuevo en AI Studio, reconecta Google AI Studio y no mezcles credenciales de Vertex. |
| 403 PERMISSION_DENIED | Acceso del proyecto, estado de la API, región o respuesta de policy. | Comprueba el proyecto y el estado de AI Studio. No intentes eludir controles de seguridad. |
| 404 NOT_FOUND | ID exacto del modelo y endpoint del proveedor. | Usa `gemini-2.5-flash-lite`, elimina el alias preview cerrado y actualiza la lista. |
| 429 RESOURCE_EXHAUSTED | RPM, TPM, RPD y nivel de facturación del proyecto. | Espera, reduce frecuencia, contexto u output y consulta las cuotas. Otra clave del mismo proyecto puede no servir. |
| 200 pero vacío | Parser de streaming, detalles de finalización, feedback de seguridad, formato y campo de texto. | Prueba con streaming desactivado y revisa consola y respuesta antes de editar la tarjeta. |
TABBIT COMO CONTEXTO
Tabbit no ejecuta tu proveedor de SillyTavern ni acepta una clave de Google AI Studio. Sirve para el trabajo alrededor: páginas fuente, referencias, capturas, PDF y tareas del navegador.
Deja una wiki, documentación o nota de ambientación en una pestaña visible. Tabbit puede resumirla en el panel lateral.
Referencia una página, captura o archivo local con @ para pedir un resumen o comprobar continuidad, sin pegar cada párrafo.
La instantánea internacional actual lista y habilita `gemini-2.5-flash-lite`. La cuenta, edición, cuota y despliegues futuros pueden variar, así que manda el selector activo. Tabbit no es la conexión de SillyTavern.

DOS TRABAJOS DISTINTOS
SillyTavern gestiona la tarjeta y la petición al proveedor. Tabbit gestiona el contexto del navegador y su asistencia nativa. Esta frontera evita convertir un campo inexistente en un paso falso.

| Necesidad | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Clave de Gemini | Créala en AI Studio y pégala en el proveedor Google AI Studio. | No hay entrada para esta clave. |
| ID estable | Elige `gemini-2.5-flash-lite` en la lista activa. | Usa los modelos que Tabbit liste realmente. |
| Tarjetas y lore | Usa controles, plantillas y contexto de RP. | Referencia una wiki, nota o archivo desde una pestaña. |
| Investigación web | Añade contexto con tu flujo de ST. | Usa @ con páginas, capturas y archivos. |
| Acciones Agent | Dependen de tu configuración de SillyTavern. | Usa su modo Agent para tareas web compatibles. |
REFERENCIAS OFICIALES
PREGUNTAS FRECUENTES
Usa `gemini-2.5-flash-lite`. Google marca `gemini-2.5-flash-lite-preview-09-2025` como cerrado.
Abre API Connections, elige Chat Completion, selecciona Google AI Studio, pega la clave de AI Studio y conecta. Vertex AI es otro proveedor.
Google publica una guía de compatibilidad, pero el comportamiento del proveedor de SillyTavern puede variar. Empieza con el proveedor Google AI Studio documentado y usa compatibilidad solo si los documentos y el conector actuales la admiten.
Los límites RPM, TPM y RPD de Google son del proyecto. Revisa uso y nivel en AI Studio, espera o reduce frecuencia, contexto y salida.
Prueba un prompt corto con streaming desactivado y revisa consola, finalización, seguridad y formato del conector. No asumas que cambiar la tarjeta arreglará un problema de parseo o cuota.
Google documenta 1.048.576 tokens de entrada y 65.536 de salida. Son techos, no una garantía de recuperación uniforme de cada detalle antiguo.
Google lo lista como compatible. El conector actual de SillyTavern puede mostrar otros controles. Si un campo no está documentado, conserva el valor predeterminado.
No. Tabbit no acepta ese proveedor ni tu clave de Google AI Studio. Mantén esta conexión en SillyTavern.
Conecta Gemini 2.5 Flash-Lite en SillyTavern. Usa Tabbit cuando la conversación dependa de páginas, archivos o acciones del navegador.
Disponible para macOS y Windows. La disponibilidad de modelos y proveedores de Tabbit puede cambiar.