語氣
文筆好不等於像這個角色
順暢的回覆可能丟掉角色的措辭、界線或情緒溫度。檢查需要出現的語氣標記,不只是看段落是否好讀。
角色扮演實測指南 / KIMI K3
Kimi K3 能寫出有畫面的對白,但 roleplay 品質不只看文筆。社群回饋提到過度思考、複讀、回覆慢、用總結取代場景,以及長對話後指令漂移。本頁給你一套小測試和分層排錯路徑。
官方事實與社群體驗分開標註。不提供 jailbreak、安全繞過或通用 preset。

RP 要看什麼
Kimi K3 API Quickstart 確認 1M token 上下文與始終開啟的 thinking。Reddit 討論有人喜歡對白和小說式 prose,也有人回報指令漂移、思考過長與供應商差異。單一事實都不能預測你的角色下一輪會怎樣。
語氣
順暢的回覆可能丟掉角色的措辭、界線或情緒溫度。檢查需要出現的語氣標記,不只是看段落是否好讀。
記憶
大視窗提供空間,但角色卡、摘要、最近幾輪和供應商處理仍會爭奪注意力。多輪後專門測試一個事實。
節奏
K3 始終會思考。更高 effort 可能帶來深度、延遲或更長前言;較低 effort 可能更俐落。用同一個場景種子對比,不要憑感覺。
10 分鐘基線
使用一張角色卡、一個場景種子和全新對話。依序執行三個測試,只重跑失敗的項目。分數是決策工具,不是 benchmark。
每項 0–2 分:0 = 失敗,1 = 不穩定,2 = 可靠。同一項連續失敗兩次時才改一個變數。
把對話、供應商、模型 alias、回覆長度和 reasoning effort 與分數一起保存,比較才可重現。
要求回覆 160–220 字。在角色卡寫出 5 個正向語氣標記和 1 個禁止習慣,不要在使用者回合再次提醒。
↳ 統計標記出現數、禁止習慣是否出現,以及有沒有多餘的 meta 旁白。
進行 8–12 輪後,要求模型說出兩個已建立事實和一個未完線索,不要再次貼上角色卡。
↳ 分別記錄正確、編造、遺漏,並注意回答是否變成總結。
交替安排安靜段、使用者動作和開放結尾。讓角色推進場景,但不要替使用者決定動作。
↳ 記錄節奏、主動性、複讀,以及結尾是否留下可繼續的入口。
現象 → 層級 → 下一步
角色卡修不了 429,調低 reasoning 也不能找回歷史裡根本不存在的事實。用這張表隔離原因。
Thinking / prompt / 歷史
開新對話,縮短指令區塊,明確場景長度;供應商支援時再比較 `reasoning_effort=low`。
角色卡 / 最近上下文
把 3 個語氣錨點放到目前指令附近,刪掉衝突範例,在第 10 輪重測回憶。
主動性約定
加入清楚界線:只描寫角色和環境,以可繼續的入口結束;不要同時改 sampler。
Reasoning / 預算 / 供應商
同一場景比較 low 與 max,記錄首 token 等待和輸出長度。X 上的速度分享只是體驗,不是 SLA。
供應商相容性
關閉 Partial Mode 執行基線,並確認供應商為 K3 支援 Partial Mode 後再加前綴。
平台規則 / prompt
不要嘗試繞過安全機制。在平台規則內改寫場景,並把語氣與合規分開評分。
K3 官方控制項包括 `reasoning_effort=low|high|max`,多個生成欄位是固定的。以目前供應商契約為準,不要照搬通用 sampler preset。
瀏覽器上下文路徑
如果 roleplay 依賴 wiki、研究頁或寫作 brief,Tabbit 能讓資料保持可見,同時在旁邊詢問 Kimi-K3。這是上下文工作流,不取代 SillyTavern 的角色卡、lorebook 或擴充功能。
把角色卡、世界觀或場景提綱留在分頁裡,瀏覽器就是你的參考面。
✓ 資料在聊天時仍然可見。

在新分頁或 Chat 的即時模型選擇器中選擇。具體可用性以版本和方案中的即時清單為準。
✓ 目前模型和記錄中的測試一致。

用 Chat 問一個聚焦問題,或用多模型檢視比較語氣和節奏。保留角色卡和對話作為評估記錄。
✓ 你能解釋模型和上下文如何產生結果。

選對工作台
先分清工具邊界,缺少功能就不會被誤判成模型問題。
| SillyTavern | Tabbit | |
|---|---|---|
| 角色卡與 lorebook | 為此設計的控制項和擴充功能 | 把可見網頁或檔案作為上下文 |
| 供應商與 preset 控制 | Endpoint、sampler、模板和歷史控制 | 即時模型選擇器與瀏覽器聊天 |
| 一致性測試 | 適合重複執行角色卡測試 | 適合貼著資料比較回答 |
| 多模型對照 | 取決於設定和擴充功能 | 多模型對話快速並列比較 |
KIMI K3 角色扮演 FAQ
如果你重視對白和長篇 prose,值得測試,但沒有通用結論。社群既有肯定文筆的回饋,也有思考過長、漂移、延遲和複讀的回饋。請用三項基線測試自己的角色卡。
不能。它提供容量,不保證完美檢索。角色卡、最近對話、摘要、供應商序列化和輸出預算都會影響 K3 注意到什麼。
K3 始終開啟 thinking。官方 API 提供 low、high、max 三檔 reasoning_effort。用同一場景比較速度和品質,不要預設 max 一定更好。
開新對話,縮短並去重指令區塊,明確場景長度;供應商支援時測試較低 effort。一次只改一層。
建立基線不需要。Partial Mode 能續寫預填的 assistant 前綴,但供應商相容性不同。先完成乾淨測試,再記錄變化後加入。
Tabbit 是瀏覽器上下文聊天工作流,不聲稱匯入 SillyTavern 角色卡、lorebook 或擴充功能。需要這些能力時繼續使用 SillyTavern;網頁或檔案是上下文時再用 Tabbit。
用一張卡、三個測試、一次只改一個變數。上下文在網頁或檔案中時,開啟 Tabbit,在旁邊試用 Kimi-K3。
支援 macOS 和 Windows。模型可用性與額度取決於版本和方案。