查看所有模型

在 Tabbit 中使用 Claude Fable 5.1

面向复杂编码、长周期 Agent 与高密度专业写作。结合官方指南、一手测评和可复用工作流,判断它在真实任务中的能力与边界。

在 Tabbit 中使用

在 Tabbit 中使用 Claude Fable 5.1

精选提示词

查看全部提示词

测评与真实反馈

查看全部测评
官方OpenRouter Model Page

OpenRouter:Claude Fable 5.1 的 Provider 性能与基准快照

OpenRouter 的实时页显示 Fable 5.1 在多个 Provider 上约有 44–56 tok/s 的一周平均吞吐、约 4.18–6.01 秒平均首段/请求延迟,并提供 GPQA Diamond、TAU-Bench 和结构化输出错误率等路由快照,适合做接入层选型而不是替代受控能力评测。

媒体Anthropic News / Introducing Claude Fable 5.1 and Claude Mythos 5.1

Claude Fable 5.1 官方发布:多基准、成本档位与安全边界

Anthropic 的发布数据把 Fable 5.1 定位为面向长时域编码、科学研究和知识工作的高端 Agent 模型,但不同 effort、工具、harness 与生产安全护栏会显著改变结果,不能只看单一榜单数字。

媒体Artificial Analysis

Artificial Analysis:Claude Fable 5.1 智能指数、任务分项与成本

Artificial Analysis 的预发布独立评测显示 Fable 5.1 在 Intelligence Index 上达到 66 分、多个 agentic 任务创最高记录,但 max 档每任务成本高于 Fable 5,xhigh 往往是更平衡的成本/能力点。

媒体SimpleBench

SimpleBench:Claude Fable 5.1 的日常推理与人类基线

SimpleBench 的公开排行榜显示 Fable 5.1 得分 86.6%,高于该项目九名人类参与者的平均基线 83.7%,说明它在空间/时间、社会常识和语言陷阱题上表现强,但人类基线样本很小且不是通用能力证明。

社区Reddit / r/ArtificialInteligence

Reddit 社区:Fable 5.1 基准质疑与任务分层体验

社区讨论认可 Fable 5.1 在高难研究/科学 Agent 任务上的官方数字,但普遍提醒基准与日常交互体验可能分离,并报告成本、配额消耗和安全护栏是实际采用边界。

Anthropic

在 Tabbit 中使用 Claude Fable 5.1

汇总 Claude Fable 5.1 的官方提示方法、Agent 工作流、配置经验与测评证据,保留原始来源、复现条件和适用边界。