跳至内容

Claude Opus 5 与 Claude Fable 5:该用哪款 Anthropic 模型?

对 Anthropic 的 Claude Opus 5 与 Claude Fable 5 进行正面对比:涵盖基准、定价、保障措施与真实工作负载。
更新 2026年7月29日  · 12分钟

用 AI 探索

在 ChatGPT 中打开在 Claude 中打开在 Perplexity 中打开

如果您正决定要把代理指向哪款 Anthropic 模型,现在有两款旗舰级选择:能力接近,但价格差距显著。Claude Opus 5 于 2026 年 7 月 24 日发布,输入每百万 token 5 美元;而 Claude Fable 5 于 2026 年 6 月 9 日发布,价格正好高出一倍。显而易见的问题是:Fable 5 的更高定价,是否能买到 Opus 5 所不具备的价值?

Anthropic 表示,Opus 5 在 Frontier-Bench、GDPval-AA 等编程与知识型工作评测中达到了新的最先进水平,而且在一些基准上,它甚至直接击败了 Fable 5。这颠覆了“更贵的模型总是更好”的常见假设。

本文将从编程、代理式任务、推理、保障措施与定价等方面对比 Opus 5 与 Fable 5,帮助您判断哪个更适合您的流程。若需针对每个模型的更深入解析,请参阅我们的 Claude Opus 5 指南Claude Fable 5 指南

要点速览

  • Opus 5 以半价(输入/输出每百万 token 5/25 美元,对比 Fable 5 的 10/50 美元)提供与 Fable 5 大致同等的智能水平,对几乎所有人而言都是更好的默认选择。
  • Opus 5 实际上在 Frontier-Bench v0.1(43.3% vs 33.7%)与 SWE-bench Verified(96.0% vs 95.0%)上胜过 Fable 5,而 Fable 5 在 SWE-bench Pro(80.3% vs 79.2%)上略胜一筹。
  • Fable 5 的 GDPval-AA v2 Elo 为 1,747,落后于 Opus 5 的 1,861;因此在知识型工作评测上,Opus 5 也领先。
  • Fable 5 搭载更重的网络安全与生物学保障措施,会将被标记的请求路由到 Opus 4.8;Opus 5 的分类器介入频率大约低 85%。
  • 仅当您确有需要其由保障措施门控的定位或 Mythos 级路由时,才选择 Fable 5;对于几乎所有通用编程、代理式与知识型任务,请选择 Opus 5。

什么是 Claude Opus 5?

Claude Opus 5 是 Anthropic 在 Opus 阶梯中的最新模型,于 2026 年 7 月 24 日发布,定价与其前身 Opus 4.8 保持一致。

Anthropic 将其描述为一款为日常使用打造的、深思熟虑且积极主动的模型。它现在是 Claude Max 的默认模型,也是 Claude Pro 上最强的模型。其标志性特征是代理式的“坚持性”:它会自我校验并迭代,直到任务真正成功,而不是在一个看似合理的答案处停下。

想了解其实际行为,请查看我们的 Claude Opus 5 API 教程,我们在其中构建并基准测试了一个跨五个推理强度级别的修复漏洞编码代理。如果您计划在代理式流程中运行 Opus 5,也可参考我们的 Claude Code 模板 指南。

什么是 Claude Fable 5?

Claude Fable 5 是一款被 Anthropic 调校为可通用安全使用的 Mythos 级模型,于 2026 年 6 月 9 日发布,输入每百万 token 10 美元、输出每百万 token 50 美元。它曾在 2026 年 6 月 12 日因遵守美国出口管制命令而短暂停用,命令解除后,Anthropic 于 2026 年 7 月 1 日恢复了访问。

Anthropic 将其在原始能力上定位高于 Opus 阶梯;在发布时,它在几乎所有已测基准上都是最先进的,而且任务越长、越复杂,其领先越明显。其独特之处在于一组分类器:对于被标记的网络安全、生物学与蒸馏请求,不会直接回答,而是路由到 Opus 4.8。

Claude Opus 5 vs Claude Fable 5:正面对比

以下是深入各个维度之前的总结。简而言之:在多数基准上,Opus 5 与 Fable 5 的差距接近噪声,但 Opus 5 的价格只有一半。

特性 Claude Opus 5 Claude Fable 5
发布日期 July 24, 2026 June 9, 2026
输入价格(每 100 万 token) $5 $10
输出价格(每 100 万 token) $25 $50
SWE-bench Verified 96.0% * 95.0%
SWE-bench Pro 79.2% 80.3% *
Frontier-Bench v0.1 43.3% * 33.7%
ARC-AGI 3 30.2% * not published
GDPval-AA v2(Elo) 1,861 * 1,747
保障策略 更轻的网络安全分类器 覆盖更广的网络安全/生物/蒸馏分类器
可用性 所有平台与阶梯 所有平台,面向消费者分阶段推出

* 当前该基准的总体领先者

编程与代理式工作流

编程是大多数人真正部署这些模型的场景,也是价格差距最难以被合理化的地方。在 SWE-bench Verified 上,Opus 5 以 96.0% 对 95.0% 领先 Fable 5 一个点;在终端编程评测 Frontier-Bench v0.1 上,Opus 5 以 43.3% 对 33.7% 拉开更大差距。

Fable 5 在 SWE-bench Pro 上以 80.3% 对 79.2% 小幅扳回一城。这是反方向的一个百分点差距,说明两者在仓库级工程任务上基本打成平手。Cognition 团队报告称,在他们的 FrontierCode 1.1 评测中,Opus 5 以一半成本逼近 Fable 级表现,这与公开数据一致。

基准 Opus 5 Fable 5 备注
SWE-bench Verified 96.0% 95.0% 厂商披露
SWE-bench Pro 79.2% 80.3% Fable 5 在此处唯一的编码胜出
Frontier-Bench v0.1 43.3% 33.7% 终端编程;Opus 5 +9.6 个百分点
Terminal-Bench 2.1 未公布 88.0% 未公布 Opus 5 分数

结论是:在编程相关的、双方均有公布数据的基准上,除 SWE-bench Pro 外,Opus 5 要么持平要么胜过 Fable 5。Anthropic 自己的说法是,Opus 5 以更低的任务成本将 Opus 4.8 的 Frontier-Bench 得分提升了一倍多,同时也胜过了 Fable 5。就编程而言,更贵的模型并未带来额外价值。

Claude Opus 5 与 Claude Fable 5 的编程对比

代理式与电脑操作任务

两款模型都面向长周期的代理式工作,因此如果您运行的是自治流水线而非一次性提示,这一维度尤为重要。在这里,Opus 5 主动验证的行为成为差异点,而基准能部分反映这一点。

在需解决新颖问题的 ARC-AGI 3 评测中,Opus 5 从 Opus 4.8 的 1.5% 跃升至 30.2%,几乎是下一款最佳模型(GPT-5.6 Sol 的 7.8%)的四倍。可惜的是,Anthropic 未公布 Fable 5 的分数,因此无法直接对比两者。

在电脑操作基准 OSWorld 2.0 上,Opus 5(70.6%)取代 Fable 5(66.1%)成为总体领先模型;在 Zapier 的 AutomationBench 上,它在此前模型完全无法完成的“防止流失”序列中达成了 100% 通过率。

以每美元计,Opus 5 在代理式任务上的优势非常明显。

推理与知识型工作

知识型工作是 Fable 5 的营销主场,因此我原本预期它会领先,但事实并非如此。在知识型工作 Elo 基准 GDPval-AA v2 上,Opus 5 以 1,861 对比 Fable 5 的 1,747,领先 114 分 Elo,而且价格更低。

Fable 5 在最困难、最长程的科学推理上仍有真实优势;Anthropic 明确表示,Mythos 级能力在长周期的自主生物研究中仍更强。但对大多数团队的分析与知识任务而言,Opus 5 更高的 GDPval-AA 得分意味着,选择 Fable 5 等于花双倍的钱却得到更差的结果。

保障措施与拒答行为

这是两款模型真正分化的维度,也是 Fable 5 作为独立产品存在的真实原因。但这也是最容易被误读的维度,因为这里有两种不同的“安全”,它们测量问题的两端。

第一是滥用抵抗力:位于模型前面的外部分类器系统,会在危险请求到达模型前进行重定向。第二是对齐性:模型自身的行为,包括是否欺骗、是否采取鲁莽且不可逆的行动,或是否会被说服去滥用。

模型在其中一项上表现良好,仍可能在另一项上需要强力支持,因为分类器并不是在防止模型“失控”,而是在防止用户从模型中获取有害内容。

Fable 5 是两者中搭载更重分类器系统的 Mythos 级模型。其分类器覆盖三个领域;一旦触发,请求将回退到 Opus 4.8:

  • 网络安全:阻断漏洞利用与更广泛的攻防任务;在分类器启用时,Fable 5 在网络安全类评测上的表现将被压到 0%。
  • 生物与化学:大多数生物与化学请求默认回退至 Opus 4.8。
  • 蒸馏:被标记为试图提取 Fable 5 能力的请求会被路由走。

Anthropic 的调校较为保守:早期数据显示,超过 95% 的 Fable 5 会话根本不会触发回退。

Opus 5 采用同类系统的轻量版本。其网络安全分类器允许进行源代码层面的漏洞查找,但会阻断基于二进制的扫描、渗透测试与漏洞利用生成;Anthropic 预计其触发频率比 Fable 5 低约 85%。

在自动化行为审计中,Opus 5 的“未对齐行为”得分为 2.3;Anthropic 称其为迄今最“对齐”的模型,领先于 Opus 4.8、Sonnet 5 与 Fable 5。

因此,这里不是计分板,而是分叉选择。对于通用编程、知识工作与电脑操作,Opus 5 是更对齐、也更少干扰的模型。而在受控领域的前沿边界,如攻防安全研究或长周期生物研究,Fable 5(或通过网络安全验证计划使用的 Mythos 5)是更有能力的工具,而更强的拒答行为正是通往该能力的代价。

定价:您实际要付多少钱

Fable 5 的输入与输出价格均恰好是 Opus 5 的两倍。Opus 5 的 Fast 模式以大约 2.5 倍默认速度运行,定价为输入 10 美元、输出 50 美元,与 Fable 5 的标准费率完全一致。

费率 Opus 5 Fable 5
输入,每 100 万 token $5.00 $10.00
输出,每 100 万 token $25.00 $50.00
Fast 模式输入,每 100 万 token $10.00 Not applicable
Fast 模式输出,每 100 万 token $50.00 Not applicable

真实工作负载的成本

两款模型共用随 Opus 4.7 世代引入的新分词器,因此相同文本在二者上的输入 token 数相同,且厂商都未公布两者在同一任务上的受控 token 计数对比。

月度规模 Opus 5 Fable 5 差额
轻量:100 万入 / 25 万出 $11.25 $22.50 Opus 5 节省 $11.25(50%)
重度:1 亿入 / 2,500 万出 $1,125 $2,250 Opus 5 节省 $1,125(50%)

在重度规模下,对于一个生产特性或持续运行的代理而言,这意味着每月 $1,125 的差额;而基准显示,您在编程或知识工作上并不会因此丧失任何表现。

不过,请将上述总额视为费率对比,而非精确预测。由于 Opus 5 往往会输出更多“思考”类 token,实际费用可能高于 Opus 4.8。但这并不改变整体结论:在多数情况下,Opus 5 仍将显著便宜于另一个模型。

Opus 5 的成本为 Fable 5 的一半何时选择 Claude Opus 5 与 Claude Fable 5

对大多数读者而言,这是一条简单的选择:Opus 5 是默认选项,Fable 5 是特例。下表涵盖会发生反转的场景。

用例 推荐 原因
仓库级编码代理 Opus 5 在 SWE-bench 上持平或更好,并以半价在 Frontier-Bench 领跑。
日常知识型工作与分析 Opus 5 GDPval-AA v2 Elo 更高(1,861 对 1,747),且价格减半。
高吞吐量生产工作负载 Opus 5 50% 的费率差在重度阶梯上每月可累计节省逾 $1,000。
新颖问题与抽象推理 Opus 5 ARC-AGI 3 得分 30.2%,为次优模型的三倍。
长周期的自主生物研究 Fable 5 Mythos 级能力在该特定工作上仍更强。
需要广覆盖保障措施的流程 Fable 5 其分类器对网络安全、生物与蒸馏的覆盖更广。

如果以下情况,请选择 Opus 5……

  • 您在构建编码或代理式工具,追求最佳性价比;它在 Frontier-Bench 上胜过 Fable 5,并在 SWE-bench 上与之打平。
  • 您运行高吞吐量工作负载,50% 的费率下降能带来实打实的预算空间,而基准也证实质量不打折。
  • 您需要目前对齐性最好的模型;其“未对齐行为”审计得分为 2.3,是 Anthropic 迄今最佳。
  • 您需要更少的正当研究拒答干扰;其分类器触发频率大约比 Fable 5 低 85%。

如果以下情况,请选择 Fable 5……

  • 您的工作是长周期的自主生物研究——Anthropic 指出这是 Mythos 级能力仍保持领先的少数领域。
  • 您明确需要 Fable 5 保障系统在网络安全、生物与蒸馏方面更广的分类器覆盖。
    Claude Opus 5 与 Fable 5 的用例

如何开始使用 Claude Opus 5 与 Claude Fable 5

两款模型在 Claude 应用、API、主流云平台与 Anthropic 的编码代理中均已广泛可用。实际差异较小,主要体现在面向消费者的套餐层级。

使用界面 Opus 5 Fable 5
消费者应用 Claude 应用(Pro、Max、Team、Enterprise 均包含;Max 默认,Pro 上最强) Claude 应用(Max 与 Team Premium:包含,50% 周度上限;Pro 与 Team Standard:仅限按量使用额度)
第一方 API Anthropic API Anthropic API
云平台 Amazon Bedrock、Vertex AI、Microsoft Foundry Amazon Bedrock、Vertex AI、Microsoft Foundry
编码代理 Claude Code、Claude Cowork Claude Code、Claude Cowork
API 模型 ID claude-opus-5 claude-fable-5

在 API 中,二者只是替换一个字符串,分别使用 claude-opus-5claude-fable-5

最明显的差异:在 Pro 与 Team Standard 套餐中,Fable 5 并不包含在内。它以 API 费率按量计费,而 Opus 5 则包含在这些套餐中。

在编码代理中使用 Opus 5 与 Fable 5

两款模型都可在 Claude Code 中选择,切换只需在请求或代理配置中更改模型字符串。由于它们共用同一 SDK,将一个可用代理从其一迁移至另一,仅需一行变更。

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # swap for "claude-fable-5"
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)

我们实测中的一个实现细节:Opus 5 默认会返回“思考”块,因此当首个块为思考块时,直接访问 response.content.text 可能会引发 AttributeError。完整的设置、努力级别调优与提示缓存行为详见我们的 Claude Opus 5 API 教程

结语

除非您有明确理由,否则我建议使用 Opus 5。它在编程上与 Fable 5 持平或更优,在知识型工作 Elo 基准上获胜,在新颖推理上将全场拉开数倍差距,同时以一半价格实现这些,并拿下 Anthropic 迄今最佳的对齐性得分。

Fable 5 显然不是糟糕的模型——它只是并非为大多数团队的日常工作而生。它配备更重的保障措施,并在如生物研究等长周期自主工作前沿具备真实优势。但在该窄领域之外,为 Fable 5 多付一倍的价钱,往往意味着在编程与分析所关心的基准上略低一筹。

我觉得最有意思的是,这次对比颠覆了常见的“型号—价格—能力”逻辑。通常,更新且更便宜的模型会为可及性牺牲部分能力。而这一次,Anthropic 推出了更便宜、却在几乎所有主流任务上更合适的模型——这意味着,Fable 5 的价格更多买到的是其保障姿态与 Mythos 血统,而非原始性能。

常见问题

Claude Opus 5 是否优于 Claude Fable 5?

对于大多数任务,是的。Opus 5 在编程方面与 Fable 5 持平或更优(SWE-bench Verified 96.0% vs 95.0%,Frontier-Bench v0.1 43.3% vs 33.7%),在 GDPval-AA v2 知识型工作基准上也领先(1,861 vs 1,747 Elo),且价格仅为其一半。Fable 5 仅在如长周期自主生物研究等前沿、窄领域保持优势。

为什么 Claude Fable 5 比 Claude Opus 5 更贵?

Fable 5 的每百万输入/输出 token 价格为 $10/$50,对比 Opus 5 的 $5/$25。但这一定价主要购买的是其保障姿态与前沿定位,而非更高的日常性能。在主流的编程与知识型基准上,Opus 5 的分数相同或更高;因此针对这些工作负载,您是在为略逊的结果支付双倍价格。

我何时应选择 Fable 5 而非 Opus 5?

当您的工作是长周期的自主生物研究(Anthropic 表示其能力仍领先),或当您明确需要其在网络安全、生物与蒸馏方面更广的分类器覆盖时,选择 Fable 5。对于通用编程、代理式流水线、分析与高吞吐量生产工作,Opus 5 是更好的默认选项。

如何在 API 中切换 Opus 5 与 Fable 5?

两款模型共用同一 SDK,切换只需将模型字符串一行改成 claude-opus-5claude-fable-5。需要注意的一点:Opus 5 默认会返回“思考”块,因此当首个块为思考块而非文本时,直接读取 response.content[0].text 可能引发 AttributeError

在实际使用中,Opus 5 的成本是否真只有 Fable 5 的一半?

按 token 费率计算,是的,Opus 5 在输入与输出上都正好是 Fable 5 的一半。实际账单取决于 token 体量,而 Opus 5 默认会比 Opus 4.8 生成更多“思考”类 token,因此将 50% 视作费率对比而非保证总额。即便如此,在大多数场景中,Opus 5 仍明显比另一款模型更省。

主题

与 DataCamp 一起学习 AI!

Tracks

AI智能体基础知识

6小时
了解 AI 智能体如何改变你的工作方式,并为你的组织创造价值!
查看详情Right Arrow
开始课程
查看更多Right Arrow