正確なIDを入力
gemini-2.5-flash-liteを使います。previewのgemini-2.5-flash-lite-preview-09-2025は終了しています。似た名前の別モデルに置き換えないでください。
GEMINI 2.5 FLASH-LITE × SILLYTAVERN
SillyTavernはGoogle AI Studio経由でGemini 2.5 Flash-Liteに接続できます。問題はprovider、正確なモデル名、キー、各ターンのコンテキスト、429や空の応答の意味にあります。

モデルを確認
GoogleはGemini 2.5 Flash-Liteを、高頻度で軽量なマルチモーダル作業向けの安定モデルとして掲載しています。テキスト、画像、動画、音声、PDFを入力でき、出力はテキストです。
gemini-2.5-flash-liteを使います。previewのgemini-2.5-flash-lite-preview-09-2025は終了しています。似た名前の別モデルに置き換えないでください。
入力上限は1,048,576 tokens、出力上限は65,536 tokensです。実際のRPM、TPM、RPDはGoogleプロジェクトと利用階層で変わります。
thinking、function calling、構造化出力、URL context、Search grounding、コード実行、キャッシュ、ファイル検索に対応します。
Google AI Studioには無料枠がありますが、モデルアクセスとトークンには制限があります。大量利用の前に現在のクォータを確認してください。
SILLYTAVERN設定
SillyTavernのGoogleガイドはChat Completionを使います。AI Studioでキーを作り、SillyTavernにモデル一覧を取得させます。まず短いリクエストでキー、クォータ、形式を切り分けます。
API keyページでログインし、Get API Keyを選び、規約に同意して作成します。キーは秘密として扱い、カードや公開画像に入れないでください。
SillyTavernのAPI ConnectionsでChat Completion、Google AI Studioの順に選び、API Key欄へ貼ってConnectを押します。
一覧にgemini-2.5-flash-liteがあれば選択します。手入力でも正確なIDを使います。終了したpreview IDはtemperatureでは直せません。
短いキャラクターカードでテストします。streamingの設定を固定し、モデル、provider、コンテキスト、応答状態を記録します。
通常のリクエストが成功したらsystem promptやloreを追加します。制御マーカーが本文に出る場合はtemplateを確認します。
Googleの制限はRPM、TPM、RPDで測定され、APIキーだけでなくプロジェクトに適用されます。
TABBITの役割
TabbitはSillyTavernのフロントエンドでも、ローカルGemma runnerでも、AI Studioキー管理ツールでもありません。キャラクターwiki、設定資料、PDF、スクリーンショットをチャットの隣で扱うブラウザです。
canonメモ、設定wiki、ドキュメントをタブに残します。Tabbitのサイドパネルで要約できます。
@を使ってページ、スクリーンショット、ファイルをプロンプトへ追加し、継続性を確認します。
現在の国際版本番スナップショットにはgemini-2.5-flash-liteが掲載・有効化されていますが、アカウント、エディション、クォータ、今後の展開で変わる可能性があります。SillyTavernのライブモデル選択を確認してください。TabbitはSillyTavern providerやGoogle AI Studio APIキーを受け付けず、この接続の代わりにはなりません。

使う場所を選ぶ
カード、メッセージ形式、生成設定はSillyTavernで扱います。資料がWebやファイルに散らばっている場合はTabbitが向いています。
| 必要なもの | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Gemini 2.5 Flash-Lite endpoint | 正確なIDで接続し、ライブ選択を確認 | Tabbitの接続ではないためSillyTavernで使う |
| APIキーとクォータ | AI Studioで管理 | このキーの入力欄なし |
| キャラクターカードとlore | 詳細なRP制御 | wikiやファイルを参照 |
| Webコンテキスト | 貼り付けまたは統合 | @でタブ、画像、ファイルを追加 |
| Agent操作 | STの設定に依存 | ブラウザのAgentモード |
公式ソース
Google AI Studioには無料枠がありますが、モデルアクセスとトークンには制限があります。大量利用の前に現在のクォータを確認してください。

FAQ
安定版はgemini-2.5-flash-liteです。gemini-2.5-flash-lite-preview-09-2025は終了しています。
API ConnectionsでChat Completion、Google AI Studioを選び、API Keyを貼って接続します。
速度または支出の上限を超えた状態です。AI StudioでプロジェクトのRPM、TPM、RPDを確認し、待つか頻度、コンテキスト、出力を減らします。
コンソールと応答詳細を確認し、streamingをオフにして短いプロンプトを試します。形式、安全フィードバック、finish detailsも確認してください。
入力上限は1,048,576 tokens、出力上限は65,536 tokensです。長いRPで全ての初期情報が同じように取得される保証ではありません。
Googleは対応を記載しています。SillyTavern側のスイッチはconnectorと設定によります。表示がない場合はパラメータを作らず、providerの既定値を使います。
AI Studioには制限付きの無料枠があります。クォータはプロジェクトと利用階層で変わるため、現在の価格ページを確認してください。
できません。TabbitはSillyTavern providerやGoogle AI Studioキーを受け付けません。Webコンテキストと表示中のモデルに使ってください。
Gemini API接続はSillyTavernで行います。チャット周辺のページ、ファイル、ブラウザ操作にはTabbitを使ってください。
macOSとWindowsに対応。モデル一覧とprovider対応は変わる場合があります。