Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
提示词
官方Gemini 3.1 Pro

Claude 主导规划、Gemini 隔离执行的 Spec 驱动编程工作流

原始来源

Google AI Developers Forum

作者YNd / MohamedEldegla

原文日期2026-04-07

Tabbit 整理2026-08-20

查看原文

一句话结论

在面对复杂长会话和严格编码规则时,通过“Claude Opus 负责需求拆解与架构审计,Gemini 3.1 Pro 独立会话单任务隔离执行,Claude 最终审计验证”的 4 步流水线,规避 Gemini 3.1 Pro 指令漂移与跳步问题,最大化发挥其高速与低成本优势。

适用场景

  • 适合的任务:复杂功能开发、大型代码库重构、多模块并行实现、预算受限下的高效 Agent 编码流。

  • 不适合的任务:试图在单个超过 50 轮的长会话中让 Gemini 3.1 Pro 自主完成端到端规划+编码+自测+文档全流程。

  • 适用的模型版本:gemini-3.1-pro、gemini-3.1-pro-preview,搭配 Claude Opus 4.6 / 4.7。

  • 适用的客户端、Agent 或 API:Google Antigravity、Gemini CLI、Cursor / Windsurf、多 Agent 编排框架。

  • 推荐的推理档位和参数:Gemini 3.1 Pro 阶段使用 thinking_level=high,保持默认 temperature=1.0;每个子任务务必使用全新会话(New Session)。

可直接使用的内容

步骤 1:需求发现与 Spec 拆解(由高规划能力模型负责)

提示词模板(运行于规划会话):

你是一个资深软件架构师。我们将通过 3 阶段访谈对功能需求进行拆解:
1. 业务逻辑与边界条件澄清
2. 模块划分与输入输出契约设计
3. 拆解为完全独立、可单测的微型 Spec 文档(每个 Spec < 300 行代码修改)

请输出格式严格的 Spec Markdown 文件,包含:
- 目标文件列表
- 确切的代码签名与类型定义
- 验收测试用例与边界断言
- 明确的负向约束(禁止修改任何非目标文件)

步骤 2:Spec 安全与副作用审计

在执行前通过静态检查或架构模型验证 Spec 是否具备自包含性,生成执行上下文工件(Context Artifact)。

步骤 3:Gemini 3.1 Pro 单任务隔离执行

提示词模板(必须新建全新会话,仅喂入单一 Spec):

你是一个专注的代码实现 Agent。
请严格仅根据下方提供的自包含 Spec 实现目标代码。

<spec>
[在此粘贴单个微型 Spec 文档内容]
</spec>

执行规则:
1. 严禁重构、修改或格式化与本 Spec 无关的任何现有代码或文件。
2. 严禁跳过测试用例的编写;必须先实现测试用例,再实现业务逻辑。
3. 如果遇到任何未定义的外部依赖,立即报错停止,不要自行猜测或引入新依赖。
4. 输出完整的代码文件,不要使用省略号或未实现的占位符。

步骤 4:独立审计与多模型回归验证

将 Gemini 3.1 Pro 的生成产物放入独立验证环境中执行自动化测试与类型检查,严禁让 Gemini 在同会话内自我审阅(Avoid "guarding its own henhouse")。

测试/工作流步骤

  1. 在规划端通过 3 轮交互完成 Epic 到微型 Spec(.md)的拆解。

  2. 将 Spec 分发给不同的全新 Gemini 3.1 Pro 会话并行实现。

  3. 汇总代码后运行 CI / Typecheck 与自动化测试套件。

  4. 记录任务成功率、耗时与 Token 消耗。

原始证据与数据

  • 论坛开发者实测表明,Gemini 3.1 Pro 在处理单轮、强聚焦的明确任务时生成速度极快且代码质量达标。

  • 在长程会话与含 4,000 词复杂前置规则的环境中,Gemini 3.1 Pro 存在跳过规划直接写代码、忽略负向约束等现象,独立会话隔离可将单任务执行成功率提升至可控范围。

适用边界

  • 该工作流依赖上游 Spec 的清晰度;若需求本身模糊,Gemini 3.1 Pro 容易选定错误理解并高速产出不符合预期的代码。

  • 必须严格执行会话隔离,不能在累积了大量历史调试信息的脏会话中持续派发新任务。

来源摘录或观察(仅做合规短引)

开发者 YNd 总结:"Every small, testable step in a new session with detailed, dedicated instruction is the only way Gemini can work nearly properly... We moved to a 'Claude-led, Gemini-fed' pipeline."

Tabbit 小编提醒

提示词内容来自公开资料与 Tabbit 编辑整理。引用前请查看原文授权与适用范围。

Gemini 3.1 Pro

在 Tabbit 中使用

Gemini 3.1 Pro

相关提示词

官方Google AI for Developers / Gemini 3 Developer Guide2026-08-04

Gemini 3.1 Pro 的简洁指令与长上下文定位提示

官方Google AI for Developers / Gemini 3 Developer Guide 与 Gemini 3.1 Pro Preview 模型页2026-02

Gemini 3.1 Pro 的思考级别、结构化输出与工具配置

社区GitHub / asgeirtj/systempromptsleaks2026-05-18

Gemini 3.1 Pro Web 端官方系统提示词与交互组件规范

社区Reddit / r/googleantigravity2026-05-15

Gemini 3.1 Pro 开源项目架构对齐与多模型结对编程工作流

Gemini 3.1 Pro

相关测评

官方Google Blog / Gemini models2026-02-19

Gemini 3.1 Pro 官方发布:ARC-AGI-2 与产品定位基线

官方Google AI Developers Forum2026-04-07

Google AI 开发者论坛:4000 词复杂系统提示词下 Gemini 3.1 Pro 的指令遵循实测

媒体LayerLens / Stratix2026-02-19

LayerLens Stratix 对 Gemini 3.1 Pro Preview 的六类基准实测

媒体Artificial Analysis2026-02-19

Artificial Analysis 对 Gemini 3.1 Pro Preview 的 182 模型综合基准与端到端延迟实测