GLM-5.2 已由 Mistral 作为第三方开源模型托管(Public Preview,模型 ID zai-glm-5-2,1M 上下文 / 128k 输出,未做任何修改),可直接在 Mistral 生态(Vibe CLI 等)中用该 ID 接入,价格为 $1.4 / $0.14(缓存输入)/ $4.4(输出)每百万 token。
适合的任务:已在 Mistral 生态(Mistral API、Vibe CLI、Mistral Code 等)中开发、想直接切换/增加 GLM-5.2 的场景;需要函数调用、结构化输出、预测输出(Predicted Outputs)、前缀缓存、批处理的接入。
不适合的任务:需要 Z.ai 官方独占能力(GLM Coding Plan 配额、tool_stream 流式工具调用、GLM-5.2[1m] 的 Claude Code 集成等)的场景;对延迟/地域有要求的场景(第三方托管节点与官方不同)。
适用的模型版本:GLM-5.2(v5.2,Mistral 侧模型 ID zai-glm-5-2;Reddit 用户实测在 Vibe CLI 的 config.toml 中设 active_model = "zai-glm-5-2" 可用)。
适用的客户端、Agent 或 API:Mistral API(/v1/chat/completions、/v1/conversations、/v1/batch);Vibe CLI。
推荐的推理档位和参数:无特殊参数要求;Mistral 明确"模型原样服务,无 Mistral 修改"(served without Mistral modifications),思考行为与官方一致。
| 项目 | 值 |
|---|---|
| 模型 ID | zai-glm-5-2 |
| 状态 | Public Preview(第三方开放模型) |
| 上下文 | 1M tokens |
| 最大输出 | 128k tokens |
| 输入价格 | $1.4 / M tokens |
| 缓存输入价格 | $0.14 / M tokens |
| 输出价格 | $4.4 / M tokens |
| 支持特性 | Chat Completions、Function Calling、Structured Outputs、Predicted Outputs、Prefix、Batching |
在 Vibe CLI 的 config.toml 中设置:
active_model = "zai-glm-5-2"(来源:r/MistralAI《Will we get GLM-5.2 in Vibe CLI?》,用户实测"this worked for me";官方文档未直接提供该 config.toml 片段,仅为社区验证写法。)
本页为 Mistral 托管视角:适合"已在使用 Mistral 生态"的开发者;与 Z.ai 官方 API 的价格/功能(如 GLM Coding Plan 配额倍数、tool_stream)不可直接互换比较。
Reddit 讨论(r/MistralAI 1vm88ur)提到该模型"好像已可通过 Mistral 托管",但 Vibe CLI 默认列表未必显示,需手动配置——实测写法见上。
GLM-5.2