官方名稱
Qwen 2026 年 8 月 3 日的公告使用 Qwen3.8-Max,並給出總參數 2.4T、啟用參數 95B。這些數字不能證明存在 27B 版本。
Qwen 3.8 · SillyTavern 實用指南
這個名稱經常被混用。Qwen 官方發布的是 Qwen3.8-Max,總參數 2.4T、啟用參數 95B。搜尋結果和社群貼文中的「Qwen3.8-27B」,本頁沒有找到相應的官方發布或 API 契約。調整預設前,先確認你的提供商實際提供哪個模型。
本指南分開處理官方證據和社群體驗,不提供繞過安全限制的方法,也不承諾每個 Tabbit 帳號都有該模型。

先把名稱弄準確
許多設定問題在第一條訊息前就發生:搜尋摘要、本地權重和託管別名被當成同一個契約。
Qwen 2026 年 8 月 3 日的公告使用 Qwen3.8-Max,並給出總參數 2.4T、啟用參數 95B。這些數字不能證明存在 27B 版本。
社群貼文和搜尋摘要可以看到「Qwen3.8-27B」,但本頁無法把它核實為官方 Qwen 檢查點。不要只憑名稱下載檔案或選擇量化。
官方範例使用 qwen3.8-max。第三方路由文章還提到預覽通道 qwen3.8-max-preview。在 SillyTavern 應使用提供商列表中的精確 ID,並記錄回傳的 model。
託管端點使用提供商規定的協定和模板,本地權重使用自己的 tokenizer 與聊天模板。不要把 Qwen 模板重複套在已經格式化訊息的端點上。
SillyTavern 設定路徑
角色卡和預設無法修復錯誤的端點。先從連線開始核對,再跑一輪短 RP 對照。
SillyTavern 是專門的 RP 前端。預設名稱和提供商行為來自各自作者與服務,不是 Qwen 發布說明的一部分。
開啟提供商目前的模型列表。如果沒有 Qwen3.8-Max,或給出的 ID 不同,就不要繼續使用猜出的 qwen3.8 別名。過濾和延遲屬於提供商現象。
OpenAI 相容路由使用 Chat Completions 和提供商文件規定的 model 欄位。Key 與 Base URL 放在提供商設定中,不要寫進角色卡或提示詞。
託管路由通常會自行序列化訊息。本地權重則等檢查點文件提供模板後,再使用 tokenizer 的官方模板。模板不匹配會看起來像 RP 能力差。
Qwen 官方說明列出 low、medium、xhigh,預設是 xhigh。先用 low 或 medium 建立延遲和格式遵循基線,再在同一張角色卡比較 xhigh。
短診斷
固定角色卡、開場、脈絡上限和輸出上限,一次只改變一個變數。
| 看到的現象 | 先檢查 | 小修復 |
|---|---|---|
| 找不到模型或靜默回退 | 提供商模型列表和回傳的 model ID | 複製準確 ID,刪除猜出的 27B 別名。 |
| 角色格式或標記異常 | 端點模式和聊天模板歸屬 | 只使用提供商模板,或只使用本地檢查點模板。 |
| 思考很久但劇情不動 | reasoning_effort、輸出上限和預設長度 | 比較 low/medium 與 xhigh,並要求場景發生一個具體變化。 |
| 角色忽略格式規則 | 規則長度、位置和目前分支 | 把簡短格式契約放到末尾,再測試兩輪。 |
| 不同提供商過濾或拒答不同 | 直連與第三方路由 | 記錄提供商行為,不把它稱為模型事實。 |
RP 提示詞契約
社群討論同時出現過度思考和格式遵循變弱的回饋。使用短契約,觀察後兩輪是否仍然遵循。
Role: 你是[角色]。 Scene: [地點、關係、目前衝突]。 Style: [視角、語言、句長]。 Direction: 每輪推進一個可觀察動作。不要替使用者說話或決定。 Continuity: 只使用已確認事實;不確定時提問。 Format: 先動作,再對話。250 到 450 字。不重述,不解釋規則。 Check: 保持語氣、格式、邊界和上一輪未解決的線索。
固定角色卡,先用關閉思考或 low 跑一次,再用 medium 或 xhigh 比較。記錄延遲、重複細節、規則遵循和劇情推進。
瀏覽器路徑
SillyTavern 適合角色卡和世界書。Tabbit 解決另一件事:讓設定 wiki、參考頁面或檔案和對話保持在一起。
開啟角色表、世界觀 wiki 或寫作簡報。可以直接引用網頁,不必把每一段複製進提示詞。
開啟 Tabbit 模型選擇器,只有當你的版本和帳號顯示 Qwen3.8-Max 時才選擇它。選擇器是 Tabbit 可用性的準确信息源。
用 @ 把開啟的分頁、截圖或檔案帶入脈絡。可以讓模型檢查連續性、短篇重寫,或對照資料事實。
用多模型對話請另一個模型閱讀同一份資料。截圖展示真實瀏覽器流程,不代表每個帳號都能使用相同模型。

Tabbit

01
官方名稱、2026-08-03 日期、2.4T 總參數、95B 啟用參數和 API 思考說明。

02
用多模型對話請另一個模型閱讀同一份資料。截圖展示真實瀏覽器流程,不代表每個帳號都能使用相同模型。
選擇前端
選擇真正負責你工作流難點的工具。兩者都能聊天,但設定入口不同。
| 需求 | SillyTavern | Tabbit |
|---|---|---|
| 角色卡和世界書 | 專門控制項 | 引用網頁和檔案 |
| 預設和提示詞順序 | 細粒度控制 | 系統提示詞和 Skills |
| 邊查資料邊 RP | 擴充功能或複製貼上 | 開啟的分頁成為脈絡 |
| 模型比較 | 設定提供商或擴充功能 | 瀏覽器內多模型對話 |
| 第一步 | 核對提供商、模板和角色卡 | 開啟資料頁,再查看選擇器 |
常見問題
本指南無法核實它是官方 Qwen 發布。Qwen 公告使用 Qwen3.8-Max,並給出總參數 2.4T、啟用參數 95B。除非官方檢查點頁面明確說明,否則應把 27B 當作未核實的社群標籤。
使用提供商回傳的準確 ID。官方範例是 qwen3.8-max,第三方路由文章提到預覽通道 qwen3.8-max-preview。不要從搜尋摘要猜別名。
託管提供商通常負責訊息序列化。本地權重應使用 tokenizer 和檢查點文件中的模板。前端和提供商同時套模板會破壞角色。
先用 low 或 medium 建立延遲基線,再用同一張角色卡比較 xhigh。Qwen 官方列出 low、medium、xhigh,預設 xhigh。思考更多不等於角色語氣一定更好。
Reddit 討論同時有長思考和快速但格式遵循較弱的回饋。請分別檢查提供商、預設長度、思考檔位和規則位置。
只有當 Tabbit 模型選擇器顯示它時才可以。可用時,可以開啟角色頁面或檔案,並用 @ 引用。可用性會因版本、地區、帳號和推出進度而不同。
安裝 macOS 或 Windows 版 Tabbit,查看模型選擇器,把角色資料帶入瀏覽器對話。
模型可用性和使用條件會因版本和推出進度而變化。