V3.2 把 thinking 直接融入 tool-use;多轮工具请求必须完整回传上一轮 reasoningcontent,否则 API 会报错或丢失推理状态,且 thinking 模式不应配置 temperature/topp。
DeepSeek 的技术报告显示 V3.2 用大规模环境/复杂指令合成来训练 Agent 泛化;使用时应把工具结果、任务约束和可验证 outcome 组织成轨迹,而不是只依赖一句“请自主思考”。
DeepSeek V3.2
整理适合 DeepSeek V3.2 的提示结构、参数设置与真实使用案例。每一项都保留原始出处。