Qwen3.8 Max · prompting-guide
围绕“Qwen3.8-Max:推理努力、上下文保持与 Agent 接入提示词指南”整理任务边界、必需输入和运行环境;完整步骤、变量与限制见详情。
模型:qwen3.8-max
推理努力:{{REASONING_EFFORT}}
任务:
{{TASK}}
工具:
{{TOOL_SCHEMA}}
验收项:
{{ACCEPTANCE_CHECKS}}
返回计划、工具参数、证据、未决问题和通过/失败。运行前仍需替换: {{TASK}}, {{REASONING_EFFORT}}, {{TOOL_SCHEMA}}, {{ACCEPTANCE_CHECKS}}
准备 Qwen3.8 Max endpoint、API key、当前支持的 reasoning_effort 值、工具 schema 和停止规则。
用同一输入分别运行低、中、高档位,固定工具、schema 和超时。
分离规划、工具调用、结果合并和最终验证,服务端校验参数与权限。
记录完成状态、输出 token、延迟、重试、工具调用和人工修正。
参数被忽略时记录实际请求并回退支持配置;额外推理没有质量收益时按工作负载降档;工具失败不自动重复副作用。
官方接入方向不证明每个 provider、客户端或 Tabbit 当前支持该参数,也没有统一成功率。
官方建议用 reasoning_effort 控制推理深度:low 适合速度和成本,medium 做平衡,xhigh 处理复杂任务;xhigh 为默认档位,preserve_thinking 默认开启。官方 API 示例还展示了如何分别处理 reasoning_content 与最终答案,以及如何把模型接入 Claude Code、Codex、Qwen Code 和 OpenClaw。
Goal: 明确最终要交付的文件、结果或系统状态。
Context: 给出会影响答案的项目文件、版本、数据和限制。
Mode: 简单任务使用 low/medium;只有复杂规划、调试和长链路工具任务才使用 xhigh。
Output: 先给结论,再给必要证据;代码必须可运行,列出验证命令。
Completion check: 执行测试或检查工具结果,报告失败项,不要把推理文本当最终答案。先用 low 建立成本/延迟基线。
medium 作为通用默认值,适合抽取、常规分析和多数编码任务。
xhigh 只用于高难架构、长程调试和需要多轮工具调用的任务,并设置 token/time 上限。
流式响应中,将 reasoning_content 与 content 分开存储、展示和统计。
多轮 Agent 要保留服务端要求的 reasoning 上下文;对于工具调用,明确工具参数、完成标准和人工审批边界。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
原文完整页面另存于同目录的官方测评文档中;本文件只保留官方文章中与提示词、参数和 Agent 接入直接相关的原文段落,避免把无关 benchmark 表格重复复制。
Qwen 官方博客《Qwen3.8-Max:编程与办公,全面跃升》 · 原文日期: 2026-08-03 · 编辑日期: 2026-09-20
阅读原始来源Qwen3.8 Max
请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。