在 Qwen3.5 的思考区块里工具调用被跳过时,可先强制模型解释调用目的再执行工具,但 Qwen3.5-Plus 仍需单独 A/B 验证。
适合的任务:OpenAI 兼容接口或自建 Agent 中,工具已注册但模型因“显而易见”而直接跳过调用的任务。
不适合的任务:服务端隐藏思考内容、工具解析器不兼容、或要求一次响应严格只输出 JSON 且不能出现中间思考的接口。
适用的模型版本:原作者明确提到 Qwen3.5 35B-A3B 和 27B;对 Qwen3.5-Plus 只是迁移假设,未被原帖验证。
适用的客户端、Agent 或 API:原作者的 open code 环境;具体 provider、工具 parser 和思考参数未公开。
推荐的推理档位和参数:原帖未公开 Plus 的参数;先保持 provider 默认值,固定模型快照,只比较“无提示”和“前置思考提示”两组。
原帖给出的是一条英文系统提示。为遵守来源短引限制,下面提供依据原意整理的可直接使用完整改写,不宣称是逐字原文:
Before every tool call, briefly reason about the goal, required inputs, and why this tool is the correct next action. Do not skip this check even when the action looks obvious. Then call the tool with only validated arguments. After the result, verify whether it answers the request; if not, explain the missing input before making another call.选择一个会触发函数调用的任务,固定相同用户消息、工具 schema、模型快照、温度和最大输出。
跑 10 次无提示基线,记录是否出现“应该调用但直接回答”、解析失败、重复调用和最终成功率。
仅加入上述系统提示,再跑 10 次;比较工具调用成功率、首个工具调用延迟和无效调用数。
在 Qwen3.5-Plus 上分别测试文本任务和图像任务;如果服务端不暴露思考区块,记录“不可观察”而不是把结果解释为提示生效。
保留原始请求、工具调用 JSON、工具返回值和最终答案,确认改进来自提示而非随机性或 parser 变化。
作者说自己多次复现 Qwen3.5 在思考区块中工具调用不执行的问题,并观察到模型在调用“显而易见”时可能跳过思考并立即调用。
作者报告在其 open code 环境加入前置思考要求后,Qwen3.5 35B-A3B、27B 不再出现该问题;没有给出样本量、成功率、随机种子、参数、工具 schema 或统计表。
原帖完整意图是“每次调用工具前都先思考”,而非增加某个具体工具或改变 API 参数;本文改写保持这一机制。
这是个人体验,不是 Qwen3.5-Plus 的受控测评;不能直接声称对 Plus 有效。
如果问题来自服务端工具解析器、消息格式或 reasoning 字段回传,系统提示不会替代协议修复。
强制每次思考可能增加延迟和 token 消耗;简单任务应同时记录成本变化。
若下游只允许结构化 JSON,需把中间思考隐藏在服务端或改用不暴露思考的工具调用协议。
原帖的可核实短引是“YOU MUST THINK EVERYTIME BEFORE YOU CALL THE TOOLS”;完整提示语与 Qwen3.5-Plus 的迁移关系均需按上述实验重新确认。
Qwen3.5 Plus