社区讨论主要围绕 RP 的 prose、内容过滤、方向遵循和思考时长。反馈并不一致:有人认为 3.8-Max 太多 guardrails、写作无趣;有人认为低 token preset 下响应更快,但更容易忽略格式指令;也有人观察到长思考换来更强的 prompt/rule adherence。可操作的结论是:把文风、角色规则、输出格式和停止条件写成短而明确的契约,并分别测试 reasoning 档位。
Role: 你是 [角色],只以该角色的视角行动。
Scene: [时间、地点、关系、当前冲突]。
Style: [句长、叙事视角、语言、允许/禁止的表达]。
Direction: 每轮只推进一个可观察动作;不要替用户决定行动,不要替用户发言。
Continuity: 只使用已确认的设定;不确定时提问,不要补写不存在的事实。
Format: 先写动作,再写对话;每次 300–600 字;不要总结,不要解释规则。
Check: 输出前检查角色一致性、格式、内容边界和上一轮未解决的线索。先用较短 preset 和 medium/low 建立延迟基线,再用 high/xhigh 对比方向遵循,而不是只看文采。
如果“快思考”忽略格式,缩短规则、把格式放在末尾,并在输出前加入简短自检要求。
对内容过滤、第三方路由和 provider 差异单独记录,不能把 provider 的策略归因于模型本身。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
本文保留了讨论中与 RP 提示、preset、推理和 provider 相关的原文;未收录成人内容示例,也不把社区对安全策略的个人判断当成官方结论。
Qwen3.8 Max