这段社区提示把高风险任务拆成多方案、风险、置信度和关键假设,适合与 Opus 4.8 的 Max effort 配合做决策草案或重要交付物。
适合的任务:定价或战略决策、重要客户交付物、需要显式暴露不确定性的方案评估。
不适合的任务:简单格式化、快速事实问答、无需多方案分析的低风险任务;这些任务可降低 effort 或不用此模板。
适用的模型版本:帖子讨论 Claude Opus 4.8;其他模型未验证。
适用的客户端、Agent 或 API:作者描述 Claude 客户端/Cowork 的 effort 控制;API 参数映射未公开,需按实际客户端核对。
推荐的推理档位和参数:界面选择 Max;API 参数、温度及 token 上限未公开/无法核实。
以下代码块为帖子公开的原始提示词,保留原文语义和结构:
This is a high-stakes task and I want your
maximum effort. Do not rush it.
The task: [describe the decision or deliverable
in full - include the context, constraints,
and what's riding on it]
Before you answer:
- Reason through multiple approaches, not just
the first one
- Consider what could go wrong with each
- Tell me where you're confident and where
you're uncertain
- Flag any assumption you're making that, if
wrong, would change your answer
Then give me your most considered output.把 [describe ...] 替换为完整背景、约束、决策对象和失败代价。
在 Claude 客户端将 effort 设为 Max;若客户端没有该档位,不要把客户端设置假设为 API 参数。
要求模型先列出多种方案,再分别列出风险、置信度和会改变结论的假设。
对高风险结论进行人工核验;把模板当作分析框架,不把模型的“置信度”当成事实证明。
与同一任务的 Low/High 运行比较输出质量、耗时和 token 消耗,记录真实差异。
帖子正文明确建议把低 effort 用于格式化、快速事实问答和校对,把 Max 留给少数真正重要的任务。
帖子给出了完整可复制模板,而不是只有标题或摘要。
帖子作者将“不确定性提示”和更少的无依据断言联系起来,但没有公开原始测试集、调用日志、样本量或统计方法。
这是个人经验和提示模板,不是 Anthropic 官方测评;帖子中关于错误率的具体数字无法仅凭该帖子复核。
Max 会增加推理成本和延迟,且不保证事实正确;重要决策仍需要领域专家、来源和数据核验。
模板强调多方案,可能让简单任务过度分析;应按任务风险选择 effort。
API 端是否支持完全相同的客户端档位、参数名称和上限,帖子未公开。
帖子用“match effort to stakes”概括其方法,并把核心模板建立在“多方案、风险、不确定性、关键假设”四个检查点上。其社区属性和缺少原始日志意味着这些内容适合作为可复用起点,而不是效果承诺。
Claude Opus 4.8