官方名称
Qwen 2026 年 8 月 3 日的公告使用 Qwen3.8-Max,并给出总参数 2.4T、激活参数 95B。这些数字不能证明存在 27B 版本。
Qwen 3.8 · SillyTavern 实用指南
这个名称常常被混用。Qwen 官方发布的是 Qwen3.8-Max,总参数 2.4T、激活参数 95B。搜索结果和社区帖子里出现的“Qwen3.8-27B”,本页没有找到对应的官方发布或 API 契约。调预设之前,先确认你的提供商实际提供了哪个模型。
本指南把官方证据和社区体验分开,不提供绕过安全限制的方法,也不承诺每个 Tabbit 账号都有该模型。

先把名称弄准确
很多设置问题在第一条消息之前就发生了:搜索摘要、本地权重和托管别名被当成了同一个契约。
Qwen 2026 年 8 月 3 日的公告使用 Qwen3.8-Max,并给出总参数 2.4T、激活参数 95B。这些数字不能证明存在 27B 版本。
社区帖子和搜索摘要中可以看到“Qwen3.8-27B”,但本页无法把它核实为官方 Qwen 检查点。不要只凭名称下载文件或选择量化。
官方示例使用 qwen3.8-max。第三方路由文章还提到预览通道 qwen3.8-max-preview。在 SillyTavern 中应使用提供商列表中的精确 ID,并记录返回的 model。
托管端点使用提供商规定的协议和模板,本地权重使用自己的 tokenizer 与聊天模板。不要把 Qwen 模板重复套到已经格式化消息的端点上。
SillyTavern 设置路径
角色卡和预设无法修复错误的端点。先从连接开始核对,再跑一轮短 RP 对照。
SillyTavern 是专门的 RP 前端。预设名称和提供商行为来自各自作者与服务,并非 Qwen 发布说明的一部分。
打开提供商当前的模型列表。如果没有 Qwen3.8-Max,或给出的 ID 不同,就不要继续使用猜出来的 qwen3.8 别名。过滤和延迟属于提供商现象。
OpenAI 兼容路由使用 Chat Completions 和提供商文档规定的 model 字段。Key 与 Base URL 放在提供商设置中,不要写进角色卡或提示词。
托管路由通常会自己序列化消息。本地权重则等检查点文档提供模板后再使用 tokenizer 的官方模板。模板不匹配会看起来像 RP 能力差。
Qwen 官方说明列出 low、medium、xhigh,默认是 xhigh。先用 low 或 medium 建立延迟和格式遵循基线,再在同一张角色卡上比较 xhigh。
短诊断
固定角色卡、开场、上下文上限和输出上限,一次只改变一个变量。
| 看到的现象 | 先检查 | 小修复 |
|---|---|---|
| 找不到模型或静默回退 | 提供商模型列表和返回的 model ID | 复制准确 ID,删除猜出来的 27B 别名。 |
| 角色格式或标记异常 | 端点模式和聊天模板归属 | 只使用提供商模板,或只使用本地检查点模板。 |
| 思考很久但剧情不动 | reasoning_effort、输出上限和预设长度 | 比较 low/medium 与 xhigh,并要求场景发生一个具体变化。 |
| 角色忽略格式规则 | 规则长度、位置和当前分支 | 把简短格式契约放到末尾,再测试两轮。 |
| 不同提供商过滤或拒答不同 | 直连与第三方路由 | 记录提供商行为,不把它称为模型事实。 |
RP 提示词契约
社区讨论同时出现了过度思考和格式遵循变弱的反馈。使用短契约,然后观察后两轮是否还在遵循。
Role: 你是[角色]。 Scene: [地点、关系、当前冲突]。 Style: [视角、语言、句长]。 Direction: 每轮推进一个可观察动作。不要替用户说话或决定。 Continuity: 只使用已确认事实;不确定时提问。 Format: 先动作,再对话。250 到 450 字。不复述,不解释规则。 Check: 保持语气、格式、边界和上一轮未解决的线索。
固定角色卡,先用关闭思考或 low 跑一次,再用 medium 或 xhigh 对比。记录延迟、重复细节、规则遵循和剧情推进。
浏览器路径
SillyTavern 适合角色卡和世界书。Tabbit 解决的是另一件事:让设定 wiki、参考页面或文件和对话保持在一起。
打开角色表、世界观 wiki 或写作简报。可以直接引用网页,不必把每一段复制进提示词。
打开 Tabbit 模型选择器,只有当你的版本和账号显示 Qwen3.8-Max 时才选择它。选择器是 Tabbit 可用性的准确信息源。
用 @ 把打开的标签页、截图或文件带入上下文。可以让模型检查连续性、短篇重写,或对照资料事实。
用多模型对话请另一个模型阅读同一份资料。截图展示的是真实浏览器流程,不代表每个账号都能使用相同模型。

Tabbit

01
官方名称、2026-08-03 日期、2.4T 总参数、95B 激活参数和 API 思考说明。

02
用多模型对话请另一个模型阅读同一份资料。截图展示的是真实浏览器流程,不代表每个账号都能使用相同模型。
选择前端
选择真正负责你工作流难点的工具。两者都能聊天,但设置入口不同。
| 需求 | SillyTavern | Tabbit |
|---|---|---|
| 角色卡和世界书 | 专门的控制项 | 引用网页和文件 |
| 预设和提示词顺序 | 细粒度控制 | 系统提示词和 Skills |
| 边查资料边 RP | 扩展或复制粘贴 | 打开的标签页成为上下文 |
| 模型比较 | 配置提供商或扩展 | 浏览器内多模型对话 |
| 第一步 | 核对提供商、模板和角色卡 | 打开资料页,再查看选择器 |
常见问题
本指南无法核实它是官方 Qwen 发布。Qwen 公告使用 Qwen3.8-Max,并给出总参数 2.4T、激活参数 95B。除非官方检查点页面明确说明,否则应把 27B 当作未经核实的社区标签。
使用提供商返回的准确 ID。官方示例是 qwen3.8-max,第三方路由文章提到预览通道 qwen3.8-max-preview。不要从搜索摘要猜别名。
托管提供商通常负责消息序列化。本地权重应使用 tokenizer 和检查点文档中的模板。前端和提供商同时套模板会破坏角色。
先用 low 或 medium 建立延迟基线,再用同一张角色卡比较 xhigh。Qwen 官方列出 low、medium、xhigh,默认 xhigh。思考更多不等于角色语气一定更好。
Reddit 讨论同时有长思考和快速但格式遵循更弱的反馈。请分别检查提供商、预设长度、思考档位和规则位置。
只有当 Tabbit 模型选择器显示它时才可以。可用时,可以打开角色页面或文件,并用 @ 引用。可用性会因版本、地区、账号和灰度而不同。
安装 macOS 或 Windows 版 Tabbit,查看模型选择器,把角色资料带入浏览器对话。
模型可用性和使用条件会因版本和灰度而变化。