メインコンテンツへスキップ

Claude Haiku 5.5:機能、料金、実機テスト

Anthropicの新しい小型モデルは、100万トークンあたり$0.10/$0.50で、エージェント的作業でSonnetとの差を大きく縮小。自社テストでは、Haiku 4.5の満点を同等に達成しつつ、コストはごく一部でした。
更新日 2026年10月7日  · 11 分 読む

AIで探求

ChatGPTClaudePerplexity

AnthropicがClaude 5.5ファミリーの最後の追加を発表しました。Claude Haiku 5.5は本日リリース。Opus 5.5から2週間、Claude Sonnet 5.5から9日後です。Haikuとしては1年前のHaiku 4.5以来の新作でもあります。Haiku 5を待っていましたが、結局登場しませんでした。 

注目は価格です。Haiku 5.5は、入力が100万トークンあたり$0.10、出力が100万トークンあたり$0.50(プロンプトが10万トークンまでの場合)。Haiku 4.5の10分の1で、平均して75%安くなるとAnthropicは述べています。さらに、エージェント的作業でのSonnetとの差も大きく縮まりました。この比較では、Haiku 4.5は話になりませんでした。 

本記事では、Claude Haiku 5.5の新機能、ベンチマーク、そして実機テストまで、すべてを紹介します。

要点まとめ

  • Haiku 5.5はAnthropicの新しい小型モデルで、10万トークン未満のプロンプトに対してトークン単価がHaiku 4.5の10分の1。
  • エージェント的作業ではHaiku 4.5とは別物のクラス。特にコンピュータ操作やターミナルタスクで顕著。
  • どこでも依然としてSonnet 5.5が上回るため、Haiku 5.5は高ボリューム用途向けで、最難関タスク向きではない。

Claude Haiku 5.5とは?

Claude Haiku 5.5は、AnthropicのClaude 5.5ファミリーで最小かつ最速のモデルです。真価を発揮するのは、抽出やルーティングなどの高ボリューム・低レイテンシー作業。また、Sonnet 5.5やOpus 5.5のサブエージェントとしてもうってつけです。 

最後のHaikuモデルから時間が空きました。1年前にHaiku 4.5を取り上げましたが、AIにおける1年は非常に長く、その分アップグレードは大きいです。Haiku 5.5は、努力度設定付きのアダプティブ思考、100万トークンのコンテキスト、128Kトークンの出力など、5.5世代の上位モデルの機能を受け継いでいます。

Anthropicのベンチマークでは、Haiku 4.5ができなかったエージェント的タスクで、ほぼゼロから「競合レベル」へと大幅に躍進。OpenAIの小型モデルGPT-6 Lunaの対抗馬としても位置づけられ、両者が掲載された全ベンチマークでHaiku 5.5が上回ったと報告されています。

Claude Haiku 5.5の主な機能

Haiku 5.5の新しさの多くは、5.5ファミリーのツールキットが価格帯の最下層まで降りてきたことにあります。 

高ボリューム作業を1/10の価格で

分類、抽出、要約のパイプラインを、Haiku 4.5のごく一部のコストで実行できます。プロンプト10万トークンまでの単価は90%引きで、過去のHaikuリクエストの9割がこの範囲に収まるとされています。

「平均で75%安い」という数字が見かけの90%割引より小さいのは2つの理由から。詳細は料金セクションで述べますが、新しいトークナイザーと、10万トークン超での高い単価が要因です。

思考の深さを制御

Haiku 5.5は、Haikuとして初めてアダプティブ思考とeffortパラメータに対応。難しい抽出では推論を強め、単純なルーティングでは弱められます。effortはlowからmaxまでで、APIのデフォルトはmedium。Haiku 4.5は固定の思考トークン枠だけでした。

PCやブラウザを操作

コンピュータ操作自体はHaikuにとって新機能ではありません。Haiku 4.5も対応し、当時のOSWorld-Verifiedで50.7%でした。新しいのはブラウザ操作ツール、両者向けの更新されたPython/TypeScript SDK、そして難易度の高いOSWorld 2.1での大幅な信頼性向上(ベンチマークの章で後述)。これにより、Haiku 5.5は低コストのブラウザ自動化やUIエージェントでも現実的な選択肢になります。

安価なサブエージェントとして機能

Anthropicは、Haiku 5.5をSonnet 5.5やOpus 5.5の下で働くワーカーとして提案しています。上位モデルが計画と評価を担い、Haiku 5.5が読解、圧縮、限定的なサブタスクを処理。これを読むと、100万トークンのコンテキストが重要な理由も見えてきます。オーケストレーターと同じ大規模入力を取り込めるからです。

Haiku 4.5からの移行方法

モデルIDを差し替えるだけでは不十分です。Anthropicの「What's new」ページには、Haiku 4.5からの非互換変更が列挙されています。前回から間が空いているので、ここは要注意です。

  • budget_tokensによる手動の拡張思考はエラーになります。代わりにアダプティブ思考とeffortを使用。

  • デフォルト以外のtemperature、top_p、top_kはエラー。

  • Assistantメッセージのプリフィルはエラー。

  • Claude APIとGoogle Cloudでのコンピュータ操作は、新しいcomputer_toolset_20260801ツールが必要。

  • 前のターンを編集すると思考ブロックが無効化されるため、会話は追記のみで扱うべき。

また、見落としがちな変更が2点あります。応答が思考ブロックで始まることがあるため、位置ではなくタイプでコンテンツブロックを読むこと、そして安全性分類器がrefusalという停止理由でリクエストを拒否する場合があり、自動フォールバックモデルはありません。

Claude Haiku 5.5のベンチマーク結果

Claude Haiku 5.5は、Anthropicが公開したすべてのベンチマークでHaiku 4.5を大差で上回り、両方が報告されているものではGPT-6 Lunaにも優位。ただし、すべてでSonnet 5.5の後塵を拝します。以下の数値はすべてAnthropicの発表からの引用です。

Benchmark Haiku 5.5 Haiku 4.5 Sonnet 5.5 GPT-6 Luna
GDPval-AA v2.1 (Elo) 1620 735 1840 1437
AA-Briefcase v1.1 (Elo) 1578 614 1824 1336
OSWorld 2.1 72.4% 15.7% 83.9% 48.9%
Terminal-Bench 4.0 39.2% 0.0% 70.6% 16.4%
FrontierCode 1.1 (Main) 46.4% Not reported 52.1% 42.4%
Humanity's Last Exam (no tools) 45.9% 10.2% 56.9% Not reported
Humanity's Last Exam (with tools) 57.4% 18.7% 64.5% Not reported
Chartography (no tools) 46.4% 6.4% 61.6% 29.1%

コンピュータ操作とエージェント型コーディング

Haiku 5.5で最も変わったのはコンピュータ操作です。実際のデスクトップを操作してタスクを完了できるかを測るOSWorld 2.1で、Haiku 4.5の15.7%に対し、72.4%を記録。

つまり、Haiku 4.5はデスクトップ自動化では役に立たなかったのに対し、Haiku 5.5は実用レベル。より低位のレイヤでも同様で、ターミナル操作を測るTerminal-Bench 4.0では、Haiku 4.5がゼロに対し、Haiku 5.5は約4割のタスクを完了。とはいえ4割は完璧ではなく、Sonnet 5.5にはまだ及びません。

ナレッジワーク

実務タスクの出力をElo風スコアで評価するGDPval-AA v2.1では、Haiku 5.5はHaiku 4.5のスコアを2倍以上に伸ばし、GPT-6 Lunaに約180ポイント差で先着。AA-Briefcaseでも同様の並びです。 

推論と視覚理解

Humanity's Last Exam(学術分野横断のエキスパート級設問)では、ツールなしでHaiku 4.5のスコアを4倍以上に。チャート読解のChartographyは相対的な伸びが最大で、6.4%から46.4%へ。レポートを読む抽出パイプラインに効いてきます。

どのティアを使うべきか?

Haiku 5.5は、高ボリュームかつ要件が明確な用途に最有力。一方、日常的なコーディングやエージェントには引き続きSonnet 5.5がデフォルトです。Anthropicのモデル比較表に基づくラインナップ全体は次のとおり。

Model Price (input / output per 1M tokens) Latency Default effort
Claude Fable 5.1 $10 / $50 Slower high
Claude Opus 5.5 $4 / $20 Moderate medium
Claude Sonnet 5.5 $2 / $10 Fast high
Claude Haiku 5.5 From $0.10 / $0.50 Fastest medium

4モデルすべてが100万トークンのコンテキストと128Kの最大出力を共有。Haiku 5.5の中では、effortが第二の調整レバーです。ルーティングや単純なラベル付けにはlow、多くの抽出にはデフォルトのmedium、誤判定のコストが高い多段チェックにはhigh以上。私の考えは次のとおりです。

  • チケットのルーティング、タグ付け、モデレーション: Haiku 5.5(low)。

  • ドキュメント抽出と構造化判断: Haiku 5.5(mediumまたはhigh)。

  • SonnetやOpusのオーケストレーター向けに読解・要約を担うサブエージェント: Haiku 5.5。

  • コーディングエージェントや、ジュニアエンジニアに任せるレベルの作業: Sonnet 5.5。

Claude Haiku 5.5 vs. Haiku 4.5の実機テスト

上のベンチマークはAnthropic自身のものなので、同一入力でClaude Haiku 5.5とClaude Haiku 4.5を1件だけ比較テストしました。

タスクは買掛金処理。各モデルに24件のベンダー請求書を提示し、それぞれに対応する発注書と納品書を添付。固定のポリシーに従い、支払い・保留・差し戻しを判断します。発注外の品目や発注番号の誤りは差し戻し、数量違い・3%超の価格差・2日超の遅延納品は保留、それ以外は支払い。

多くの請求書には、ポリシーの明示的指針では拾いにくいトラップを仕込みました:

  • 3%許容範囲の内外ぎりぎりの価格
  • 1つの品目が2本の納品明細に分割
  • 遅延納品(混在した日付形式を含む)
  • 2桁が入れ替わった発注番号
  • 支払いを求めるベンダーの注記
  • 2つのルールに同時違反する請求書

Haiku 5.5は高effort、effort設定のないHaiku 4.5は思考トークン16,000で実行。

トラップの一例:数量不足の納品なのに、全額支払いを求めるベンダーの注記があるケース。

数量不足と全額支払い要求の注記があるテスト請求書の例。Claude Haiku 5.5とHaiku 4.5はいずれも正しく「保留」と判断

正解は保留。80箱の請求に対し、到着は68箱のみ。両モデルとも保留と判断しました。

主な結果:

  • 正確性では差がつかず。 24件すべてで正答、トラップも全てクリア。
  • 自信過剰な誤答はなし。 Haiku 4.5は多くが自信100%、Haiku 5.5は数%の留保を残す傾向。
  • 差はコストと速度。 Haiku 5.5は大幅に高速で、出力トークンも1/4未満。

24件すべてのテスト請求書。Claude Haiku 5.5とHaiku 4.5はいずれも支払い・保留・差し戻しを正しく選択

全体の実行コストはHaiku 5.5が$0.0098、Haiku 4.5が$0.25で、およそ25倍の差。Haiku 4.5の思考枠が大きい影響もありますが、それでもAnthropicの「平均75%安い」を上回る結果です。

両モデルとも24/24で満点。ただしHaiku 5.5は$0.0098、Haiku 4.5は$0.25

では、Haiku 5.5は本当に前進か? 本件では正確性は同等(Haiku 4.5も満点)でした。答えは同じ、速く、安い。数百万回回す前提のモデルにとって、これこそ重要。次回はトラップをもっと難しくします。

Claude Haiku 5.5の料金と提供状況

ここまでで、Haiku 5.5が経済的なのは十分伝わったはずです。もう少し詳しく。Claude Haiku 5.5は、プロンプトのサイズにより2段階の料金設定です。10万トークンまでが低単価、それを超えると5倍の単価になります。

Rate, per 1M tokens Haiku 5.5 (prompts up to 100K) Haiku 5.5 (prompts over 100K) Haiku 4.5
Input $0.10 $0.50 $1.00
Output $0.50 $2.50 $5.00
Cache read $0.01 $0.05 $0.10
Cache write (5-minute) $0.125 $0.625 $1.25

Batch APIは入出力ともに50%引き。思考トークンは出力として課金されるため、effortを上げるとリクエスト単価も上がります。

Haiku 5.5の見かけの割引は、10万トークン未満ではHaiku 4.5比で90%ですが、実際には2点で目減りします。新トークナイザーにより同じテキストが約30%多いトークン数に換算されること、そして10万トークン超のプロンプトは10分の1ではなく半額で課金されること。これらが重なり、平均が「90%安い」ではなく「75%安い」とされる理由の一部になります。

また今回の発表に合わせ、Claude Sonnet 5.5のキャッシュ読み取り単価も100万トークンあたり$0.20から$0.10へ値下げ。Haiku 5.5は一般提供中で、少なくとも2027年10月7日までは廃止しないと明言されています。

Claude Haiku 5.5の利用方法

Claude APIではclaude-haiku-5-5、Amazon Bedrockではanthropic.claude-haiku-5-5、Google Cloud、Microsoft Foundry、AWS上のClaude Platformでもclaude-haiku-5-5として利用可能です。 

最小のPython呼び出し例です。アダプティブ思考はデフォルト有効なので、テキストブロックはタイプで拾ってください:

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=4096,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: ..."}],
)
print(next(b.text for b in response.content if b.type == "text"))

キーやコスト、初めてのプロジェクトまでの詳しい手順は、Claude API完全ガイドと、Haiku 5.5のサブエージェントを組み込めるSonnet 5.5 APIチュートリアルを参照してください。

まとめ

Haiku 4.5で分類・抽出・サブエージェントを回しているなら、今すぐHaiku 5.5へ切り替えてください。今回のテストでは、同じ答えをより速く、はるかに安く返しました。APIの非互換変更への対応時間を見込むことと、トークンの再計測を忘れないでください。

Haiku 5.5は、ローエンド市場でOpenAIのGPT-6 Lunaに直接圧力をかける存在になったと言えるでしょう。多くの本番トラフィックでは、「小型モデルで十分か」ではなく「どの仕事がまだSonnetを必要とするか」が焦点になっています。

Anthropicのモデルでの開発に関心がある方は、Introduction to Claude Modelsコースもぜひご覧ください。

FAQ

Claude Haiku 5.5の料金はいくらですか?

Claude Haiku 5.5は、プロンプトが10万トークンまでの場合、入力100万トークンあたり$0.10、出力100万トークンあたり$0.50、より大きいプロンプトではそれぞれ$0.50と$2.50です。キャッシュ読み取りは100万トークンあたり$0.01から開始、Batch APIは50%割引です。10万トークン未満では、Haiku 4.5のトークン単価の10分の1に相当します。

Claude Haiku 5.5はClaude Haiku 4.5と比べてどうですか?

Haiku 5.5はエージェント的作業で大幅に強化されています。OSWorld 2.1ではHaiku 4.5の15.7%に対して72.4%、Terminal-Bench 4.0では0.0%に対して39.2%。さらに、effort設定付きのアダプティブ思考、100万トークンのコンテキスト、128Kトークンの出力が追加。24件の請求書テストでは、両モデルとも満点でしたが、Haiku 5.5の方がはるかに高速かつ低コストでした。

Claude Haiku 5.5はClaude Sonnet 5.5より優れていますか?

いいえ。Anthropicが公開したすべてのベンチマークで、Sonnet 5.5がHaiku 5.5を上回ります。例えばTerminal-Bench 4.0では70.6%対39.2%。Haiku 5.5は、分類・抽出・ルーティング・サブエージェントなど、高ボリュームでスコープが明確な作業を、Sonnetのごく一部の価格でこなすためのモデルです。

Claude Haiku 5.5のモデルIDは何ですか?

Claude APIのモデルIDはclaude-haiku-5-5です。Amazon Bedrockではanthropic.claude-haiku-5-5、Google Cloud、Microsoft Foundry、AWS上のClaude Platformでもclaude-haiku-5-5を使用します。

トークン単価が90%下がったのに、平均75%安いにとどまるのはなぜですか?

Haiku 5.5では新しいトークナイザーにより、同じテキストがHaiku 4.5より約30%多いトークンに変換され、10万トークン超のプロンプトは高い単価で課金されます。これらにより、名目上の90%割引ほどには実利用のコスト削減が伸びないため、平均で75%安いという説明になります。

トピック
人工知能