Evening-Truth 在提示词库中单独开了一页投诉 Z.AI Coding Plan 的响应质量:
主张:订阅 z.ai coding plan 后,"经常甚至永久"看到响应质量大幅下降;作者用同一批测试调用对比 z.ai 与 OpenRouter,差异"大到无法忽视"。
猜测:订阅用户的高用量调用可能被路由到重度量化版本或 7B/14B 蒸馏模型。
引用来源:
r/ZaiGLM https://www.reddit.com/r/ZaiGLM/comments/1rki1v0/("Is GLM-5 assigning quantized models to high-usage users?",6 个月前)
r/SillyTavernAI https://www.reddit.com/r/SillyTavernAI/comments/1roxv8a/("glm_quality_via_subscription_or_paygo")
被引用的 r/ZaiGLM 帖要点(本次已打开核对):u/Super_Product_9470 反映老订阅(无周配额上限)高用量用户 GLM-5 频繁推理循环、答案不连贯、疑似被路由到量化/轻量模型;多位评论者(老订阅、重度用户)确认同样现象;也有评论者认为是上下文长度相关(接近 80k–100k 时开始劣化)。
作者立场:"订阅调用可能被重路由到重度量化或蒸馏版本……这不是好的生意做法。"
重要边界(必须注意):作者引用的 Reddit 证据(r/ZaiGLM 1rki1v0 等)明确是关于 GLM-5(2026 年 2 月前后,早于 GLM-5.2 发布)的 Coding Plan 质量问题;本页显示日期也早于 GLM-5.2 发布。因此这份材料是"Z.AI Coding Plan 服务质量的持续性社区投诉",不能直接证明 GLM-5.2 本身被降级,仅作为服务层风险提示。
与《06-Reddit-PoeAI-GLM-5.2质量下降讨论》相互印证的方向:托管/订阅渠道可能存在与模型能力无关的质量波动,遇到异常应换渠道对照。
证据等级:个人体验 + 社区二手引述,无受控测量;作者自称做过对比调用但未公开数据。
"if you have a subscription to the z.ai coding plan you will often, if not permanently see a massive dip in response qua… 以上为必要节选,完整内容请查看原文。
"It's possible subscriber calls are being re-routed to a heavily quantized version or a distillation of 7B maybe 14B."
"Either way... that's not how good business is done."
GLM-5.2