在面对复杂长会话和严格编码规则时,通过“Claude Opus 负责需求拆解与架构审计,Gemini 3.1 Pro 独立会话单任务隔离执行,Claude 最终审计验证”的 4 步流水线,规避 Gemini 3.1 Pro 指令漂移与跳步问题,最大化发挥其高速与低成本优势。
适合的任务:复杂功能开发、大型代码库重构、多模块并行实现、预算受限下的高效 Agent 编码流。
不适合的任务:试图在单个超过 50 轮的长会话中让 Gemini 3.1 Pro 自主完成端到端规划+编码+自测+文档全流程。
适用的模型版本:gemini-3.1-pro、gemini-3.1-pro-preview,搭配 Claude Opus 4.6 / 4.7。
适用的客户端、Agent 或 API:Google Antigravity、Gemini CLI、Cursor / Windsurf、多 Agent 编排框架。
推荐的推理档位和参数:Gemini 3.1 Pro 阶段使用 thinking_level=high,保持默认 temperature=1.0;每个子任务务必使用全新会话(New Session)。
提示词模板(运行于规划会话):
你是一个资深软件架构师。我们将通过 3 阶段访谈对功能需求进行拆解:
1. 业务逻辑与边界条件澄清
2. 模块划分与输入输出契约设计
3. 拆解为完全独立、可单测的微型 Spec 文档(每个 Spec < 300 行代码修改)
请输出格式严格的 Spec Markdown 文件,包含:
- 目标文件列表
- 确切的代码签名与类型定义
- 验收测试用例与边界断言
- 明确的负向约束(禁止修改任何非目标文件)在执行前通过静态检查或架构模型验证 Spec 是否具备自包含性,生成执行上下文工件(Context Artifact)。
提示词模板(必须新建全新会话,仅喂入单一 Spec):
你是一个专注的代码实现 Agent。
请严格仅根据下方提供的自包含 Spec 实现目标代码。
<spec>
[在此粘贴单个微型 Spec 文档内容]
</spec>
执行规则:
1. 严禁重构、修改或格式化与本 Spec 无关的任何现有代码或文件。
2. 严禁跳过测试用例的编写;必须先实现测试用例,再实现业务逻辑。
3. 如果遇到任何未定义的外部依赖,立即报错停止,不要自行猜测或引入新依赖。
4. 输出完整的代码文件,不要使用省略号或未实现的占位符。将 Gemini 3.1 Pro 的生成产物放入独立验证环境中执行自动化测试与类型检查,严禁让 Gemini 在同会话内自我审阅(Avoid "guarding its own henhouse")。
在规划端通过 3 轮交互完成 Epic 到微型 Spec(.md)的拆解。
将 Spec 分发给不同的全新 Gemini 3.1 Pro 会话并行实现。
汇总代码后运行 CI / Typecheck 与自动化测试套件。
记录任务成功率、耗时与 Token 消耗。
论坛开发者实测表明,Gemini 3.1 Pro 在处理单轮、强聚焦的明确任务时生成速度极快且代码质量达标。
在长程会话与含 4,000 词复杂前置规则的环境中,Gemini 3.1 Pro 存在跳过规划直接写代码、忽略负向约束等现象,独立会话隔离可将单任务执行成功率提升至可控范围。
该工作流依赖上游 Spec 的清晰度;若需求本身模糊,Gemini 3.1 Pro 容易选定错误理解并高速产出不符合预期的代码。
必须严格执行会话隔离,不能在累积了大量历史调试信息的脏会话中持续派发新任务。
开发者 YNd 总结:"Every small, testable step in a new session with detailed, dedicated instruction is the only way Gemini can work nearly properly... We moved to a 'Claude-led, Gemini-fed' pipeline."
Gemini 3.1 Pro