Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
提示词与工作流

GLM-5.2 · configuration

从 GLM-5.1 / GLM-5 / GLM-4.x 迁移到 GLM-5.2 的官方配置指南

官方给出的 GLM-5.2 迁移清单与参数配置:模型 ID 改为 `glm-5.2`、`temperature` 默认 1.0 / `top_p` 默认 0.95(二选一调参)、思考默认开启、`reasoning_effort` 用 `high` 或 `max`、流式与工具流式(`stream=true` + `tool_stream=true`)需按官方方式拼接,并附可直接使用的 Python 迁移示例。

来源待核验Z.AI API migration from GLM-5.1/5/4.x

前置条件与输入

  • old request
  • new model ID
  • streaming flags
  • regression task

完整可复制模板

编辑改写:从 GLM-5.1 / GLM-5 / GLM-4.x 迁移到 GLM-5.2 的官方配置指南

Tabbit 编辑改写;非来源原文
把 {{旧请求}} 迁移到 {{新模型ID}};在 {{回归任务}} 比较 {{采样字段}}、{{流式开关}} 和 {{工具流式}},保存 {{请求差异}}。

运行前仍需替换: {{旧请求}}, {{新模型ID}}, {{回归任务}}, {{采样字段}}, {{流式开关}}, {{工具流式}}, {{请求差异}}

从 GLM-5.1/5/4.x 请求保存一份基线,逐项更新 model ID、temperature/top_p、thinking、stream 和 tool_stream。先用同一回归任务比较文本、工具调用和错误处理,再删除旧字段;失败时回滚单项改动,避免同时改变采样与上下文。

查看来源研究笔记

一句话结论

官方给出的 GLM-5.2 迁移清单与参数配置:模型 ID 改为 glm-5.2、temperature 默认 1.0 / top_p 默认 0.95(二选一调参)、思考默认开启、reasoning_effort 用 high 或 max、流式与工具流式(stream=true + tool_stream=true)需按官方方式拼接,并附可直接使用的 Python 迁移示例。

适用场景

  • 适合的任务:从 GLM-5.1、GLM-5、GLM-4.7/4.6/4.5 等旧模型切换到 GLM-5.2 的存量应用;需要流式输出、流式工具调用、思考内容读取的 Agent/编码产品;需要明确采样参数与思考档位的后端集成。

  • 不适合的任务:依赖"关闭思考省 token"的旧逻辑(GLM-5.2 思考默认开启,应改用 reasoning_effort 控制成本);GLM-4.7 时代的"强制思考"行为假设(GLM-5.2 是模型自动判断是否需要思考)。

  • 适用的模型版本:GLM-5.2(文中参数对 GLM-5.1/GLM-5 系列同样适用,思考默认行为一致)。

  • 适用的客户端、Agent 或 API:Z.ai Chat Completions API(OpenAI 兼容);使用 delta.reasoning_content / delta.content / delta.tool_calls 的流式客户端。

  • 推荐的推理档位和参数:thinking: {"type": "enabled"}(复杂推理/编码推荐开启);reasoning_effort: high(增强推理)或 max(深度推理,默认);temperature 与 top_p 只调其中一个;max_tokens 按任务设置(上限 128K)。

可直接使用的内容

官方迁移检查清单(节选)

  • 模型标识改为 glm-5.2

  • 采样参数:temperature 默认 1.0、top_p 默认 0.95,建议只调其中一个

  • 深度思考:按需 thinking={"type": "enabled"} 用于复杂推理/编码

  • 推理档位:reasoning_effort 在 high(增强推理)与 max(深度推理,默认)之间选择

  • 流式响应:stream=true,正确处理 delta.reasoning_content 与 delta.content

  • 流式工具调用:stream=true + tool_stream=true,流式拼接 delta.tool_calls[*].function.arguments

  • 最大输出与上下文:max_tokens 按需设置(GLM-5.2 上限 128K 输出、1M 上下文)

  • 提示词优化:配合深度思考使用更清晰的指令和约束

  • 开发环境验证:回归测试关注随机性、延迟、工具流式参数完整性

更新采样参数(官方示例)

# Plan A: Use temperature (recommended)
resp = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Write a more creative brand introduction"}],
    temperature=1.0
)

# Plan B: Use top_p
resp = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Generate more stable technical documentation"}],
    top_p=0.8
)

深度思考与推理档位(官方示例)

resp = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Design a three-tier microservice architecture for me"}],
    thinking={"type": "enabled"},
    reasoning_effort="max"
)

流式输出 + 流式工具调用(官方示例,可直接复制)

response = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "How's the weather in Beijing"}],
    tools=[
        {
            "type": "function",
            "function": {
                "name": "get_weather",
                "description": "Get current weather conditions for a specified location",
                "parameters": {
                    "type": "object",
                    "properties": {
                        "location": {"type": "string", "description": "City, eg: Beijing, Shanghai"},
                        "unit": {"type": "string", "enum": ["celsius", "fahrenheit"]}
                    },
                    "required": ["location"]
                }
            }
        }
    ],
    stream=True,
    tool_stream=True,
)

# Initialize streaming collection variables
reasoning_content = ""
content = ""
final_tool_calls = {}
reasoning_started = False
content_started = False

# Process streaming response
for chunk in response:
    if not chunk.choices:
        continue

    delta = chunk.choices[0].delta

    # Streaming reasoning process output
    if hasattr(delta, 'reasoning_content') and delta.reasoning_content:
        if not reasoning_started and delta.reasoning_content.strip():
            print("\n🧠 Thinking Process:")
            reasoning_started = True
        reasoning_content += delta.reasoning_content
        print(delta.reasoning_content, end="", flush=True)

    # Streaming answer content output
    if hasattr(delta, 'content') and delta.content:
        if not content_started and delta.content.strip():
            print("\n\n💬 Answer Content:")
            content_started = True
        content += delta.content
        print(delta.content, end="", flush=True)

    # Streaming tool call information (parameter concatenation)
    if delta.tool_calls:
        for tool_call in delta.tool_calls:
            idx = tool_call.index
            if idx not in final_tool_calls:
                final_tool_calls[idx] = tool_call
                final_tool_calls[idx].function.arguments = tool_call.function.arguments
            else:
                final_tool_calls[idx].function.arguments += tool_call.function.arguments

# Output final tool call information
if final_tool_calls:
    print("\n📋 Function Calls Triggered:")
    for idx, tool_call in final_tool_calls.items():
        print(f"  {idx}: Function Name: {tool_call.function.name}, Parameters: {tool_call.function.arguments}")

GLM-5.2 新特性(迁移视角)

  • 上下文最大 1M、输出最大 128K。

  • 新增工具调用过程流式输出(tool_stream=true),可实时拿到工具调用参数。

  • 深度思考 thinking={"type":"enabled"}:开启后模型自动判断是否思考(区别于 GLM-4.7 的强制思考)。

  • 新增 reasoning_effort 参数控制思考档位。

  • 更强的代码能力与推理能力。

注意与边界

  • 官方原文使用"深度思考默认开启"表述:思考在 GLM-5.2/5.1/5/4.7 系列默认激活(见思考模式文档),与 GLM-4.6 的混合思考默认行为不同。

  • 迁移后回归重点:输出随机性是否过大或过于保守、工具流式拼接是否正常、长上下文与深度思考下的延迟与成本。

来源与日期

Z.ai 官方开发者文档(docs.z.ai,Get Started / Migrate) · 原文日期: 2026-06 · 编辑日期: 2026-09-20

阅读原始来源
变量检查

仍需替换: 7

{{旧请求}}{{新模型ID}}{{回归任务}}{{采样字段}}{{流式开关}}{{工具流式}}{{请求差异}}

相关提示词

GLM-5.2 官方文档 Overview 与 API 快速开始(docs.z.ai)GLM-5.2 思考模式配置:默认思考 / 交错思考 / 保留思考 / 回合级思考(官方)通过 Mistral 平台使用 GLM-5.2(zai-glm-5-2):第三方托管配置与定价GLM-5.2 角色扮演(RP)系统提示词:Evening-Truth 黑暗版完整提示词

相关测评

NIST CAISI 对 Z.ai GLM-5.2 的独立能力评估Semgrep IDOR 基准:GLM-5.2 在安全代码审计中的裸提示词结果GLM-5.2 官方发布说明与完整跑分表(Z.ai 博客)Reddit 盲代码评审:GLM-5.2 的生产就绪评分与多裁判复核

模型深度阅读

总览 · 简体中文

GLM-5.2 是什么:价格、部署与适用边界

说明 GLM-5.2 的 2026 年 6 月发布、1M 上下文、开源权重、API 计费、编码证据与安全试用边界。

GLM-5.2

在 Tabbit 中使用 GLM-5.2

请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。