把 Claude Code 的主会话留在 Sonnet 4.6,只在研究或安全测试时派 Opus 子代理,作者称 4 个并行会话跑 14 小时以上仍只用掉约 20% 周额度。
适合的任务:多会话日常开发、需要撑过一周额度的实现/修补;规划或安全审查才升级。
不适合的任务:整个仓库的架构决策、高风险重构、必须全程最强模型的审计。
适用的模型版本:Claude Sonnet 4.6 作默认执行;Opus 仅子代理。评论区有人配合 /model opusplan。
适用的客户端、Agent 或 API:Claude Code(含并行会话和 subagent)。
推荐的推理档位和参数:帖文未给 effort;核心是模型分层而不是把主会话开到 Opus。
主会话约束(可放进项目 CLAUDE.md 或每次开场):
Default model: Claude Sonnet 4.6 for implementation, edits, tests, and routine refactors.
Do not switch the main session to Opus.
If the task is architecture research, threat modeling, or security testing,
launch a subagent on Opus, then return a short plan and evidence to this session.
Execute the plan here with Sonnet 4.6.
Keep four or fewer parallel sessions unless the token budget is explicitly raised.需要官方规划/执行切换时,叠加:
/model opusplan额度紧张时的检查项:
1. 主会话是否仍是 claude-sonnet-4-6?
2. 是否只对研究/安全测试派了 Opus 子代理?
3. 1M 窗口是否误开并触发 extra-usage?同一周内用两组配置:A 全程 Opus;B 主会话 Sonnet 4.6 + 必要时 Opus 子代理。
固定并行会话数(作者用 4 个)、仓库和任务类型。
记录周额度百分比、完成的 PR/任务数、返工次数和安全相关漏项。
若使用 opusplan,再核对执行阶段模型 ID 和上下文窗口是 200k 还是 1M。
作者原文:默认用 Sonnet 4.6 是为了“一小时内不把 token 预算打光”;4 个并行会话跑 14+ 小时,只用约 20% 周额度。
作者给的升级条件:研究或安全测试时,让它 launch a subagent with opus。
评论 robbyatcuprbotlabs:/model opusplan 后(Max 20x)不再一天打掉 25% 额度。
评论 asenna987:在 Max 5x 上强制 1M 窗口会报 Extra usage is required for 1M context。
这是额度与路由经验,没有公开仓库、prompt 或质量评分。
20% 周额度依赖作者的任务密度、套餐和并行方式,不能当成所有人的消耗公式。
“大多数工作用 Sonnet 4.6”与官方推荐一致,但不证明 Sonnet 4.6 在高风险任务上等于 Opus。
子代理把上下文隔离开,主会话只能看到摘要;安全测试结论必须带回可验证证据。
没有完整提示词样本;CLAUDE.md 片段是按原帖工作流整理的可复制约束,不是作者原文逐字导出。
作者原文第一句是 “Use Sonnet 4.6 for most of your work.”(合规短引)。
Claude Sonnet 4.6