官方建议用 reasoning_effort 控制推理深度:low 适合速度和成本,medium 做平衡,xhigh 处理复杂任务;xhigh 为默认档位,preserve_thinking 默认开启。官方 API 示例还展示了如何分别处理 reasoning_content 与最终答案,以及如何把模型接入 Claude Code、Codex、Qwen Code 和 OpenClaw。
Goal: 明确最终要交付的文件、结果或系统状态。
Context: 给出会影响答案的项目文件、版本、数据和限制。
Mode: 简单任务使用 low/medium;只有复杂规划、调试和长链路工具任务才使用 xhigh。
Output: 先给结论,再给必要证据;代码必须可运行,列出验证命令。
Completion check: 执行测试或检查工具结果,报告失败项,不要把推理文本当最终答案。先用 low 建立成本/延迟基线。
medium 作为通用默认值,适合抽取、常规分析和多数编码任务。
xhigh 只用于高难架构、长程调试和需要多轮工具调用的任务,并设置 token/time 上限。
流式响应中,将 reasoning_content 与 content 分开存储、展示和统计。
多轮 Agent 要保留服务端要求的 reasoning 上下文;对于工具调用,明确工具参数、完成标准和人工审批边界。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
原文完整页面另存于同目录的官方测评文档中;本文件只保留官方文章中与提示词、参数和 Agent 接入直接相关的原文段落,避免把无关 benchmark 表格重复复制。
Qwen3.8 Max