メインコンテンツへスキップ

Claude Opus 5 vs Claude Fable 5:どの Anthropic モデルを使うべきか

Anthropic の Claude Opus 5 と Claude Fable 5 を、ベンチマーク、料金、セーフガード、実運用ワークロードで比較します。
更新 2026年7月29日  · 12 分 読む

AIで探索

ChatGPTで開くClaudeで開くPerplexityで開く

エージェントにどの Anthropic モデルを使わせるべきか検討しているなら、いまは能力が近く価格が大きく離れたフラッグシップ級が2つあります。Claude Opus 5 は 2026 年 7 月 24 日に公開され、入力 100 万トークンあたり 5 ドル。一方の Claude Fable 5 は 2026 年 6 月 9 日に公開され、そのちょうど倍です。では、Fable 5 の上位ティアは Opus 5 がすでに提供しているもの以上の価値をもたらすのでしょうか。

Anthropic は、Opus 5 が Frontier-Bench や GDPval-AA といったコーディングおよびナレッジワーク評価で新たな最先端だと述べており、ベンチマークによっては Fable 5 を明確に上回ります。高価なモデルが常に勝つという通念をひっくり返す結果です。

本記事では、コーディング、エージェントタスク、推論、安全策、料金の観点で Opus 5 と Fable 5 を比較し、どちらがワークフローに合うか判断できるようにします。各モデル個別の詳しい解説は、Claude Opus 5 ガイドClaude Fable 5 ガイドをご覧ください。

要点(TL;DR)

  • Opus 5 は概ね Fable 5 と同等の知能を半額で提供(100 万トークンあたり $5/$25 vs $10/$50)。ほとんどの人にとって優先すべきデフォルトです。
  • Opus 5 は Frontier-Bench v0.1(43.3% vs 33.7%)と SWE-bench Verified(96.0% vs 95.0%)で Fable 5 を上回り、SWE-bench Pro では Fable 5 がわずかに優勢(80.3% vs 79.2%)。
  • GDPval-AA v2 の Elo は Fable 5 が 1,747 で、Opus 5 の 1,861 を下回り、ナレッジワーク評価でも Opus 5 がリード。
  • Fable 5 はサイバー・生物系のより重いセーフガードを搭載し、フラグが立つと Opus 4.8 にルーティング。Opus 5 の分類器は介入頻度が約 85% 低い。
  • Fable 5 を選ぶのは、セーフガード重視のポジショニングや Mythos クラスのルーティングが必要な場合のみ。一般的なコーディング、エージェント、ナレッジワークには Opus 5 を。

Claude Opus 5 とは?

Claude Opus 5 は Opus ティアの最新モデルで、2026 年 7 月 24 日にリリースされ、先代の Opus 4.8 と同価格で提供されています。

Anthropic は、日常利用向けに設計された思慮深く主体的なモデルと位置づけており、現在は Claude Max のデフォルト、Claude Pro では最強のモデルです。特徴はエージェント的な粘り強さで、もっともらしい回答で止まらず、実際にタスクが成功するまで自己検証と反復を行います。

実際の挙動は、全 5 段階の推論努力レベルでバグ修正コーディングエージェントを構築・ベンチマークするClaude Opus 5 API チュートリアルで確認できます。エージェントワークフロー内で Opus 5 を動かす予定なら、Claude Code テンプレートのガイドも役立ちます。

Claude Fable 5 とは?

Claude Fable 5 は一般利用向けに安全化された Mythos クラスのモデルで、2026 年 6 月 9 日に公開(入力 100 万トークンあたり 10 ドル、出力 100 万トークンあたり 50 ドル)。2026 年 6 月 12 日に米国の輸出管理命令に対応するため一時的に提供停止となり、7 月 1 日に解除を受けて再開されました。

Anthropic は生の能力では Opus ティアの上位に位置づけており、公開時点ではほぼすべての検証済みベンチマークで最先端を記録、タスクが長く複雑になるほど優位が拡大しました。特徴は、サイバーセキュリティ、生物学、蒸留に関するフラグが立ったリクエストを直接回答せず Opus 4.8 にルーティングする分類器群です。

Claude Opus 5 vs Claude Fable 5:項目別の直接比較

各観点を深掘りする前に要約を示します。短く言えば、ベンチマークの多くで Opus 5 と Fable 5 は誤差範囲に収まりますが、Opus 5 はそれを半額で実現します。

項目 Claude Opus 5 Claude Fable 5
リリース日 July 24, 2026 June 9, 2026
入力単価(100万トークンあたり) $5 $10
出力単価(100万トークンあたり) $25 $50
SWE-bench Verified 96.0% * 95.0%
SWE-bench Pro 79.2% 80.3% *
Frontier-Bench v0.1 43.3% * 33.7%
ARC-AGI 3 30.2% * not published
GDPval-AA v2(Elo) 1,861 * 1,747
セーフガードの姿勢 軽量なサイバー分類器 広範なサイバー/バイオ/蒸留分類器
提供状況 すべてのプラットフォームとティア すべてのプラットフォーム、消費者向けは段階的展開

* このベンチマークの現時点での総合トップ

コーディングとエージェントワークフロー

実際に多くの人がこれらのモデルを使うのはコーディングであり、価格差の正当性が最も薄れる領域でもあります。SWE-bench Verified では、Opus 5 が 96.0%、Fable 5 が 95.0% と、低価格の Opus 5 が 1 ポイントのリード。ターミナルコーディング評価の Frontier-Bench v0.1 では、43.3% 対 33.7% と差がさらに広がります。

一方で Fable 5 は SWE-bench Pro で 80.3% と、Opus 5 の 79.2% に僅差で勝利。こちらは逆に 1 ポイント差で、リポジトリ単位のエンジニアリングでは実質的に互角といえます。Cognition のチームは FrontierCode 1.1 で、Opus 5 がコスト半分で Fable に迫る性能だと報告しており、公開された数字とも整合します。

ベンチマーク Opus 5 Fable 5 補足
SWE-bench Verified 96.0% 95.0% ベンダー公表値
SWE-bench Pro 79.2% 80.3% 本表での Fable 5 の唯一のコーディング勝ち
Frontier-Bench v0.1 43.3% 33.7% ターミナルコーディング;Opus 5 が +9.6pp
Terminal-Bench 2.1 未公表 88.0% Opus 5 のスコアは未公表

結論として、SWE-bench Pro だけを例外に、公開されているコーディング系ベンチマークでは Opus 5 は Fable 5 に並ぶか上回ります。Anthropic 自身の説明でも、Opus 5 は Opus 4.8 の Frontier-Bench スコアをコスト低減とともに 2 倍以上に引き上げ、Fable 5 にも勝つと述べています。コーディング用途では、高価なモデルを選ぶメリットはありません。

Claude Opus 5 と Claude Fable 5 のコーディング比較

エージェントタスクとコンピュータ操作

両モデルは長期的なエージェント作業向けに設計されており、ワンショットのプロンプトではなく自律パイプラインを運用する場合に重要です。ここでは、Opus 5 の主体的な検証挙動が差別化要因で、ベンチマークにも一部反映されています。

未知課題の解決力を測る ARC-AGI 3 では、Opus 5 は Opus 4.8 の 1.5% から 30.2% へと跳ね上がり、次点モデル(GPT-5.6 Sol の 7.8%)のほぼ 4 倍です。残念ながら、Anthropic は Fable 5 のスコアを公表しておらず、直接比較はできません。

コンピュータ操作ベンチマークの OSWorld 2.0 では、Opus 5(70.6%)が Fable 5(66.1%)に代わって総合トップとなり、Zapier の AutomationBench では、従来モデルが完遂できなかった離反防止シーケンスで 100% の合格率を達成しました。

エージェントタスクにおけるコスト当たりの性能では、Opus 5 が大差で優位です。

推論とナレッジワーク

ナレッジワークは Fable 5 の主要な訴求領域なので、ここでは優位だと予想していましたが、実際はそうではありません。ナレッジワークの Elo ベンチマークである GDPval-AA v2 では、Opus 5 が 1,861、Fable 5 が 1,747。より安価なモデルに 114 Elo の差をつけられています。

とはいえ、最も難度が高く長大な科学的推論では Fable 5 に分がありますし、長期の自律的な生物学研究では Mythos クラスが依然として強いと Anthropic も明言しています。しかし多くのチームが行う分析・ナレッジタスクでは、GDPval-AA の高スコアが示すとおり、Fable 5 は価格が倍で成績は下がるという状況です。

セーフガードと拒否挙動

両モデルが本質的に分かれるのはここであり、Fable 5 が別製品として存在する理由でもあります。同時に、最も誤解されやすい領域でもあります。ここで「安全性」と呼ばれているものは 2 種類あり、問題の両極を測定しているからです。

1 つ目は悪用耐性:モデルの前段に置かれ、危険なリクエストを到達前に迂回させる外部分類器システム。2 つ目はアラインメント:欺瞞、軽率で不可逆な行動、悪用への誘導など、モデル自身の振る舞いの整合性です。

分類器は「モデルが暴走すること」を防ぐわけではないため、片方で高得点でも他方で重い支援を必要とすることはあり得ます。分類器が守るのは、ユーザーが有害な内容を引き出すことに対してです。

Fable 5 は 2 つのうち重い分類器を備える Mythos クラスのモデルです。分類器は 3 領域をカバーし、起動するとリクエストは Opus 4.8 にフォールバックします。

  • サイバーセキュリティ:脆弱性悪用や広範な攻撃的タスクをブロックし、分類器が有効な場合はサイバー系評価の成績が 0% に張り付きます。
  • 生物学・化学:大半の生物学・化学リクエストは既定で Opus 4.8 にフォールバックします。
  • 蒸留:Fable 5 の能力抽出を狙ったとフラグされるリクエストは迂回されます。

Anthropic はこれらを保守的にチューニングしており、初期データでは Fable 5 のセッションの 95% 超でフォールバックは一度も発動しません。

Opus 5 は同系統の軽量版を搭載。サイバー分類器はソースコードの脆弱性探索は許可しつつ、バイナリベースのスキャン、ペネトレーションテスト、エクスプロイト生成をブロックし、Fable 5 より発動頻度が約 85% 低い見込みです。

自動化行動監査では、Opus 5 の不整合行動スコアは 2.3 と、Opus 4.8、Sonnet 5、Fable 5 を上回る同社史上最良のアラインメントを記録しました。

つまり、ここは勝敗表ではなく用途分岐です。一般的なコーディング、ナレッジワーク、コンピュータ操作では、Opus 5 はよく整合したモデルで、邪魔が少ない選択です。攻撃的セキュリティ研究や長期の生物学などガードされた領域の最前線では、Fable 5(または Cyber Verification Program 経由の Mythos 5)がより有能で、そのための重い拒否挙動は代償といえます。

料金:実際に支払う額

Fable 5 は入力・出力ともに Opus 5 のちょうど 2 倍です。Opus 5 の Fast モードはデフォルト比で約 2.5 倍速で動作し、入力 $10、出力 $50 と、Fable 5 の標準レートと同額になります。

レート Opus 5 Fable 5
入力(100万トークンあたり) $5.00 $10.00
出力(100万トークンあたり) $25.00 $50.00
Fast モード入力(100万トークンあたり) $10.00 該当なし
Fast モード出力(100万トークンあたり) $50.00 該当なし

実運用のコスト感

両モデルは Opus 4.7 世代からの新トークナイザを共有しているため、同一テキストの入力トークン数は同じです。同一タスクでの厳密なトークン数比較は、いずれのベンダーからも公開されていません。

月間ボリューム Opus 5 Fable 5 差額
軽量:100万 in / 25万 out $11.25 $22.50 Opus 5 は $11.25(50%)節約
重量:1億 in / 2,500万 out $1,125 $2,250 Opus 5 は $1,125(50%)節約

重量クラスでは、本番機能や常時稼働エージェントで月あたり $1,125 の差となり、ベンチマークによればコーディングやナレッジワークの性能を犠牲にせずに実現できます。

ただし、これらは正確な見積もりというよりレート比較と考えてください。Opus 5 は思考トークンをより多く出す傾向があるため、実運用では Opus 4.8 より高くつくこともありますが、それでも両モデルの比較として Opus 5 の方が大幅に安価という構図は変わりません。

Opus 5 のコストは Fable 5 の半分Claude Opus 5 と Claude Fable 5 をどう選ぶか

多くの読者にとって結論は簡単です。Opus 5 が基本。Fable 5 は例外です。以下はその判断が逆転するシナリオです。

ユースケース 推奨 理由
リポジトリ単位のコーディングエージェント Opus 5 SWE-bench で同等以上、Frontier-Bench でリードし、コストは半分。
日常的なナレッジワークと分析 Opus 5 GDPval-AA v2 の Elo が高い(1,861 vs 1,747)うえで半額。
大量の本番ワークロード Opus 5 50% の削減は重量ティアで月 $1,000 超の差に。
未知課題・抽象推論 Opus 5 ARC-AGI 3 が 30.2% と、次点モデルの 3 倍。
長期の自律的な生物学研究 Fable 5 この領域では Mythos クラスが依然として強力。
広範なセーフガードが必要なワークフロー Fable 5 サイバー/生物/蒸留により広く分類器が対応。

以下に当てはまるなら Opus 5 を選択

  • コーディングやエージェントツールを構築し、コスト当たりの性能を重視する。Frontier-Bench で Fable 5 を上回り、SWE-bench では互角だから。
  • 大量ワークロードで 50% のレート差が実予算に直結し、品質も犠牲にならないとベンチマークで確認できる。
  • もっとも整合したモデルを求めている(不整合行動スコア 2.3 は Anthropic の過去最高)。
  • 正当なセキュリティ研究で拒否が少ない方がよい(分類器の発動は Fable 5 比で約 85% 減)。

以下に当てはまるなら Fable 5 を選択

  • 長期の自律的な生物学研究に取り組んでいる(この領域は Mythos クラスが依然として優位)。
  • Fable 5 のセーフガードが提供する、サイバー/生物/蒸留にまたがる広範な分類器カバレッジが特に必要。
    Claude Opus 5 と Fable 5 のユースケース

Claude Opus 5 と Claude Fable 5 の始め方

両モデルは Claude アプリ、API、大手クラウド、Anthropic のコーディングエージェントで広く利用可能です。実務的な差は小さく、主にコンシューマープランのレベルで現れます。

提供面 Opus 5 Fable 5
コンシューマーアプリ Claude アプリ(Pro・Max・Team・Enterprise に含む;Max でデフォルト、Pro で最強) Claude アプリ(Max と Team Premium:含む、週次上限 50%;Pro と Team Standard:クレジット制のみ)
ファーストパーティ API Anthropic API Anthropic API
クラウドプラットフォーム Amazon Bedrock、Vertex AI、Microsoft Foundry Amazon Bedrock、Vertex AI、Microsoft Foundry
コーディングエージェント Claude Code、Claude Cowork Claude Code、Claude Cowork
API モデル ID claude-opus-5 claude-fable-5

API では、それぞれ claude-opus-5claude-fable-5 という文字列を差し替えるだけです。

最も明確な差は、Pro と Team Standard では Fable 5 が含まれない点です。API レートの従量クレジットでのみ利用可能で、Opus 5 はこれらのプランに含まれます。

コーディングエージェントでの Opus 5/Fable 5 の使い分け

両モデルは Claude Code で選択可能で、切り替えはリクエストやエージェント設定のモデル文字列を変更するだけです。同じ SDK を共有しているため、動作中のエージェントを片方からもう片方へ移すのは 1 行変更で済みます。

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # swap for "claude-fable-5"
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)

実地テストでの実装メモ:Opus 5 は既定で thinking ブロックを返すため、先頭ブロックが thinking の場合に response.content.text を直接参照すると AttributeError が発生することがあります。完全なセットアップ、努力レベルの調整、プロンプトキャッシュの挙動はClaude Opus 5 API チュートリアルで解説しています。

まとめ

特段の理由がない限り、Opus 5 を使うことを推奨します。コーディングでは Fable 5 と同等以上、ナレッジワークの Elo ベンチマークでも勝ち、未知課題の推論では他モデルを大きく引き離します。それでいて価格は半分で、Anthropic 史上最高のアラインメントスコアを記録しています。

Fable 5 が悪いモデルというわけではありません。ただ、チームが実際に行う大半の作業に特化してはいないのです。重いセーフガードを搭載し、生物学のような長期自律タスクの最前線では真価を発揮しますが、その狭い領域を外れると、Fable 5 を選ぶのは「倍の価格で、コーディングや分析で重要なベンチマークのスコアがやや低い」ことを意味します。

この比較で興味深いのは、一般的なモデル階層の常識を逆転させている点です。通常は、新しく安価なモデルはアクセス性のために能力をいくらか犠牲にします。今回は、Anthropic がより安価で、しかも主流タスクのほぼすべてでより有能な選択肢を出しており、Fable 5 の価格は生の性能というより、セーフガードの姿勢や Mythos 系譜に対して支払っていることを示唆しています。

FAQs

Claude Opus 5 は Claude Fable 5 より優れていますか?

多くのタスクでは、そのとおりです。Opus 5 はコーディングで Fable 5 に並ぶか上回り(SWE-bench Verified で 96.0% vs 95.0%、Frontier-Bench v0.1 で 43.3% vs 33.7%)、ナレッジワークの GDPval-AA v2 でもリード(1,861 vs 1,747 Elo)。しかも価格は半分です。Fable 5 が優位なのは、長期の自律的な生物学研究といった先端の狭い領域に限られます。

なぜ Claude Fable 5 は Claude Opus 5 より高価なのですか?

Fable 5 は入力/出力それぞれ 100 万トークンあたり $10/$50 と、Opus 5 の $5/$25 の倍額です。ただし、このプレミアムの多くは、日常業務での性能向上ではなく、セーフガードの姿勢やフロンティア領域での位置づけに対するものです。一般的なコーディングやナレッジワークのベンチマークでは Opus 5 が同等か上回るため、その用途では「倍額を払って少し劣る」ことになります。

Opus 5 ではなく Fable 5 を選ぶのはどんなときですか?

長期の自律的な生物学研究(この領域では依然として能力が先行)に取り組む場合、またはサイバー・生物・蒸留にまたがるより広範な分類器カバレッジが特に必要な場合は Fable 5 を選んでください。一般的なコーディング、エージェントパイプライン、分析、大量の本番運用には Opus 5 がより適しています。

API で Opus 5 と Fable 5 を切り替える方法は?

両モデルは同じ SDK を共有しており、モデル文字列(claude-opus-5 または claude-fable-5)を 1 行変更するだけです。注意点として、Opus 5 は既定で thinking ブロックを返すため、先頭ブロックが thinking の場合に response.content[0].text を直接読むと、AttributeError が発生することがあります。

実運用でも Opus 5 は Fable 5 の半額程度で済みますか?

トークン単価では、そのとおりで、Opus 5 は入力・出力とも Fable 5 のちょうど半額です。実際の請求額はトークン量に左右され、Opus 5 は既定で Opus 4.8 より思考トークンを多く出す傾向があるため、50% はレート比較として捉えてください。それでも多くのシナリオで、Opus 5 の方がもう一方より有意に安価です。

トピック

DataCamp で AI を学ぼう!

Tracks

AIエージェントの基礎

6時間
AIエージェントが、あなたの働き方と組織への価値提供をどう変えられるかを発見しましょう!
詳細を見るRight Arrow
コースを開始
もっと見るRight Arrow