GEMINI 2.5 FLASH-LITE × 角色扮演

讓劇情前進,不要原地重述

Gemini 2.5 Flash-Lite 速度快、成本低,但角色扮演效果取決於每一輪送出的提示。使用者常遇到角色漂移、重述動作和創意不穩。先寫清楚規則,再一次只改一個設定。

查看測試流程
Tabbit 桌面模型選擇器,聊天輸入框旁顯示 Gemini 模型選項。

角色扮演難點

上下文很大,也救不了混亂的提示

百萬 token 輸入上限可以容納更多 lore,但不代表每個早期細節都同樣容易取回。社群有人覺得 Flash 長對話自然穩定,也有人遇到改寫使用者動作和文風變平。這些是個人經驗,不是基準測試。

01

角色聲線會滑走

角色一開始有清楚節奏,長場景後卻回到泛化敘述。

02

你的動作被重述

回覆重複上一輪,而不是帶來後果或新的可選行動。

03

Lore 越多,焦點可能越少

超長角色卡會壓住目前場景。把長期設定和本輪狀態分開。

Google 官方資料

先了解模型,再調整它

Google 將 Gemini 2.5 Flash-Lite 列為適合高頻輕量工作的穩定多模態模型。它接受文字、圖片、影片、音訊和 PDF,輸出文字。官方上限是邊界,不等於完美記憶。

01

使用穩定 ID

使用 `gemini-2.5-flash-lite`。Google 已將 `gemini-2.5-flash-lite-preview-09-2025` 列為關閉。

02

上下文和輸出

輸入上限為 1,048,576 tokens,輸出上限為 65,536 tokens。配額仍取決於專案和使用層級。

03

支援 thinking

Google 列出 thinking、快取、函式呼叫、結構化輸出、URL context、Search grounding、程式碼執行和檔案搜尋。

04

安全回饋也是結果的一部分

被攔截或空回覆可能來自安全回饋或格式問題。遵守 provider 規則並查看 finish 詳情。

可控的 RP 流程

先調規則,再調採樣

用同一段短場景比較變化。記錄模型、提示版本、上下文大小、輸出長度和一條品質備註,較容易找到原因。

01

寫場景契約

說明模型控制誰、必須推進什麼、哪些內容留給使用者。加入:「不要重述使用者動作,結尾留下使用者可以接住的開口。」

02

分開狀態與 lore

用短狀態區記錄地點、關係、未解決動作和語氣。長期設定放在只在相關時觸發的 lore 條目。

03

設定輸出目標

指定符合自己回合的範圍,例如兩到四段。回覆太短時先提高輸出上限,再考慮 temperature。

04

一次改一個變數

先測試 temperature 或 top-p,不要同時改。保持角色卡和使用者回合一致,比較兩三次生成。

05

檢查失敗原因

重複時縮短指令並刪掉重複例子。漂移時加入一條具體 canon 提醒。被攔截時查看安全回饋,改寫無害措辭。

不要使用 jailbreak 或繞過過濾器。這會讓排錯更難,也可能違反 provider 規則。

排錯表

長對話的快速診斷

最有用的線索通常來自請求和回應狀態,而不是論壇裡又一個新預設。

現象先試什麼再檢查什麼
重述或改寫我的回合加入不要重述規則,刪掉重複範例。只改角色卡一處,再比較同一提示。
角色聲線漂移用短場景狀態區加一條語氣提示。確認舊 lore 是否擠占目前回合。
回覆太短提高輸出上限,或指定段落範圍。之後再測 temperature,不要同時改 top-p。
429 RESOURCE_EXHAUSTED等待、降低頻率,減少上下文或輸出。查看專案 RPM、TPM、RPD。同一專案換 Key 可能無效。
空回覆或被攔截用短小無害提示並查看 finish 和安全詳情。先測試格式和 streaming,再重寫整張卡。

TABBIT 的位置

把設定資料放在對話旁邊

Tabbit 給角色扮演資料一個瀏覽器工作區。把世界觀 wiki、參考圖片和場景大綱留在分頁裡,再讓瀏覽器原生模型做總結或連續性檢查。當前國際版 picker 快照列出 Gemini 2.5 Flash-Lite,但可用性和配額會變。

  1. 1

    開啟參考分頁

    保留 lore wiki、角色表或 PDF。比較提示時,資料仍在手邊。

  2. 2

    用 @ 補充上下文

    用 @ 引用開啟的頁面、截圖或本機檔案,整理簡短連續性清單,不必貼上整篇 wiki。

  3. 3

    選擇實際顯示的模型

    目前生產快照的國際版目錄列出 Gemini 2.5 Flash-Lite。如果你的 picker 不同,使用實際列出的模型並查看限額。Tabbit 不接收你的 SillyTavern provider Key。

Tabbit Agent 模式旁顯示 Google Sheets、指令和執行步驟。

Google 官方資料

上下文和輸出

輸入上限為 1,048,576 tokens,輸出上限為 65,536 tokens。配額仍取決於專案和使用層級。

Tabbit 桌面瀏覽器中的模型選擇器。Tabbit Agent 模式旁顯示 Google Sheets、指令和執行步驟。

常見問題

Gemini 2.5 Flash-Lite 角色扮演問答

Gemini 2.5 Flash-Lite 適合角色扮演嗎?+

它可以是快速、低成本的選項。社群體驗不一致,有人覺得文風穩定,也有人遇到重複或變平。先用固定提示測試。

要填哪個模型 ID?+

使用 `gemini-2.5-flash-lite`。Google 已將 `gemini-2.5-flash-lite-preview-09-2025` 預覽版列為關閉。

一百萬 tokens 代表完美記憶嗎?+

不代表。這是官方記錄的輸入上限。用滾動場景狀態區仍有助於讓目前事實保持可見。

temperature 和 top-p 要一起改嗎?+

不要。比較時固定一個變數。先穩定提示和輸出目標,再單獨改 temperature 或 top-p。

為什麼它重述我的動作?+

社群使用者確實報告過改寫和重述。加入不要重述規則,刪掉重複範例,改一項後比較同一回合。

可以繞過安全攔截嗎?+

不要繞過安全系統。查看 finish 和安全回饋,保持請求無害,必要時調整場景措辭。

Tabbit 支援這個模型嗎?+

目前國際版生產模型快照將 Gemini 2.5 Flash-Lite 列為 picker 中已啟用的模型。帳號或版本可能不同,頁面不承諾無限存取或 SillyTavern provider 注入。

Tabbit 能取代 SillyTavern 嗎?+

不能。SillyTavern 仍適合角色卡和 provider 專屬 RP 控制。Tabbit 用來把網頁、檔案和模型上下文放在一起。

先測試場景,再把資料放近

使用準確模型 ID,一次只改一個設定,並把安全回饋納入排錯。下一回合需要 wiki、截圖或檔案時,開啟 Tabbit。

支援 macOS 和 Windows。模型可用性與限額可能變化。

© 2026 Tabbit Browser. 理解你上下文的 AI 原生瀏覽器。