AnthropicがClaude 5.5ファミリーの最後の追加を発表しました。Claude Haiku 5.5は本日リリース。Opus 5.5から2週間、Claude Sonnet 5.5から9日後です。Haikuとしては1年前のHaiku 4.5以来の新作でもあります。Haiku 5を待っていましたが、結局登場しませんでした。
注目は価格です。Haiku 5.5は、入力が100万トークンあたり$0.10、出力が100万トークンあたり$0.50(プロンプトが10万トークンまでの場合)。Haiku 4.5の10分の1で、平均して75%安くなるとAnthropicは述べています。さらに、エージェント的作業でのSonnetとの差も大きく縮まりました。この比較では、Haiku 4.5は話になりませんでした。
本記事では、Claude Haiku 5.5の新機能、ベンチマーク、そして実機テストまで、すべてを紹介します。
要点まとめ
- Haiku 5.5はAnthropicの新しい小型モデルで、10万トークン未満のプロンプトに対してトークン単価がHaiku 4.5の10分の1。
- エージェント的作業ではHaiku 4.5とは別物のクラス。特にコンピュータ操作やターミナルタスクで顕著。
- どこでも依然としてSonnet 5.5が上回るため、Haiku 5.5は高ボリューム用途向けで、最難関タスク向きではない。
Claude Haiku 5.5とは?
Claude Haiku 5.5は、AnthropicのClaude 5.5ファミリーで最小かつ最速のモデルです。真価を発揮するのは、抽出やルーティングなどの高ボリューム・低レイテンシー作業。また、Sonnet 5.5やOpus 5.5のサブエージェントとしてもうってつけです。
最後のHaikuモデルから時間が空きました。1年前にHaiku 4.5を取り上げましたが、AIにおける1年は非常に長く、その分アップグレードは大きいです。Haiku 5.5は、努力度設定付きのアダプティブ思考、100万トークンのコンテキスト、128Kトークンの出力など、5.5世代の上位モデルの機能を受け継いでいます。
Anthropicのベンチマークでは、Haiku 4.5ができなかったエージェント的タスクで、ほぼゼロから「競合レベル」へと大幅に躍進。OpenAIの小型モデルGPT-6 Lunaの対抗馬としても位置づけられ、両者が掲載された全ベンチマークでHaiku 5.5が上回ったと報告されています。
Claude Haiku 5.5の主な機能
Haiku 5.5の新しさの多くは、5.5ファミリーのツールキットが価格帯の最下層まで降りてきたことにあります。
高ボリューム作業を1/10の価格で
分類、抽出、要約のパイプラインを、Haiku 4.5のごく一部のコストで実行できます。プロンプト10万トークンまでの単価は90%引きで、過去のHaikuリクエストの9割がこの範囲に収まるとされています。
「平均で75%安い」という数字が見かけの90%割引より小さいのは2つの理由から。詳細は料金セクションで述べますが、新しいトークナイザーと、10万トークン超での高い単価が要因です。
思考の深さを制御
Haiku 5.5は、Haikuとして初めてアダプティブ思考とeffortパラメータに対応。難しい抽出では推論を強め、単純なルーティングでは弱められます。effortはlowからmaxまでで、APIのデフォルトはmedium。Haiku 4.5は固定の思考トークン枠だけでした。
PCやブラウザを操作
コンピュータ操作自体はHaikuにとって新機能ではありません。Haiku 4.5も対応し、当時のOSWorld-Verifiedで50.7%でした。新しいのはブラウザ操作ツール、両者向けの更新されたPython/TypeScript SDK、そして難易度の高いOSWorld 2.1での大幅な信頼性向上(ベンチマークの章で後述)。これにより、Haiku 5.5は低コストのブラウザ自動化やUIエージェントでも現実的な選択肢になります。
安価なサブエージェントとして機能
Anthropicは、Haiku 5.5をSonnet 5.5やOpus 5.5の下で働くワーカーとして提案しています。上位モデルが計画と評価を担い、Haiku 5.5が読解、圧縮、限定的なサブタスクを処理。これを読むと、100万トークンのコンテキストが重要な理由も見えてきます。オーケストレーターと同じ大規模入力を取り込めるからです。
Haiku 4.5からの移行方法
モデルIDを差し替えるだけでは不十分です。Anthropicの「What's new」ページには、Haiku 4.5からの非互換変更が列挙されています。前回から間が空いているので、ここは要注意です。
-
budget_tokensによる手動の拡張思考はエラーになります。代わりにアダプティブ思考とeffortを使用。 -
デフォルト以外の
temperature、top_p、top_kはエラー。 -
Assistantメッセージのプリフィルはエラー。
-
Claude APIとGoogle Cloudでのコンピュータ操作は、新しい
computer_toolset_20260801ツールが必要。 -
前のターンを編集すると思考ブロックが無効化されるため、会話は追記のみで扱うべき。
また、見落としがちな変更が2点あります。応答が思考ブロックで始まることがあるため、位置ではなくタイプでコンテンツブロックを読むこと、そして安全性分類器がrefusalという停止理由でリクエストを拒否する場合があり、自動フォールバックモデルはありません。
Claude Haiku 5.5のベンチマーク結果
Claude Haiku 5.5は、Anthropicが公開したすべてのベンチマークでHaiku 4.5を大差で上回り、両方が報告されているものではGPT-6 Lunaにも優位。ただし、すべてでSonnet 5.5の後塵を拝します。以下の数値はすべてAnthropicの発表からの引用です。
| Benchmark | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 | GPT-6 Luna |
|---|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 735 | 1840 | 1437 |
| AA-Briefcase v1.1 (Elo) | 1578 | 614 | 1824 | 1336 |
| OSWorld 2.1 | 72.4% | 15.7% | 83.9% | 48.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 70.6% | 16.4% |
| FrontierCode 1.1 (Main) | 46.4% | Not reported | 52.1% | 42.4% |
| Humanity's Last Exam (no tools) | 45.9% | 10.2% | 56.9% | Not reported |
| Humanity's Last Exam (with tools) | 57.4% | 18.7% | 64.5% | Not reported |
| Chartography (no tools) | 46.4% | 6.4% | 61.6% | 29.1% |
コンピュータ操作とエージェント型コーディング
Haiku 5.5で最も変わったのはコンピュータ操作です。実際のデスクトップを操作してタスクを完了できるかを測るOSWorld 2.1で、Haiku 4.5の15.7%に対し、72.4%を記録。

つまり、Haiku 4.5はデスクトップ自動化では役に立たなかったのに対し、Haiku 5.5は実用レベル。より低位のレイヤでも同様で、ターミナル操作を測るTerminal-Bench 4.0では、Haiku 4.5がゼロに対し、Haiku 5.5は約4割のタスクを完了。とはいえ4割は完璧ではなく、Sonnet 5.5にはまだ及びません。
ナレッジワーク
実務タスクの出力をElo風スコアで評価するGDPval-AA v2.1では、Haiku 5.5はHaiku 4.5のスコアを2倍以上に伸ばし、GPT-6 Lunaに約180ポイント差で先着。AA-Briefcaseでも同様の並びです。
推論と視覚理解
Humanity's Last Exam(学術分野横断のエキスパート級設問)では、ツールなしでHaiku 4.5のスコアを4倍以上に。チャート読解のChartographyは相対的な伸びが最大で、6.4%から46.4%へ。レポートを読む抽出パイプラインに効いてきます。
どのティアを使うべきか?
Haiku 5.5は、高ボリュームかつ要件が明確な用途に最有力。一方、日常的なコーディングやエージェントには引き続きSonnet 5.5がデフォルトです。Anthropicのモデル比較表に基づくラインナップ全体は次のとおり。
| Model | Price (input / output per 1M tokens) | Latency | Default effort |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | Slower | high |
| Claude Opus 5.5 | $4 / $20 | Moderate | medium |
| Claude Sonnet 5.5 | $2 / $10 | Fast | high |
| Claude Haiku 5.5 | From $0.10 / $0.50 | Fastest | medium |
4モデルすべてが100万トークンのコンテキストと128Kの最大出力を共有。Haiku 5.5の中では、effortが第二の調整レバーです。ルーティングや単純なラベル付けにはlow、多くの抽出にはデフォルトのmedium、誤判定のコストが高い多段チェックにはhigh以上。私の考えは次のとおりです。
-
チケットのルーティング、タグ付け、モデレーション: Haiku 5.5(
low)。 -
ドキュメント抽出と構造化判断: Haiku 5.5(
mediumまたはhigh)。 -
SonnetやOpusのオーケストレーター向けに読解・要約を担うサブエージェント: Haiku 5.5。
-
コーディングエージェントや、ジュニアエンジニアに任せるレベルの作業: Sonnet 5.5。
Claude Haiku 5.5 vs. Haiku 4.5の実機テスト
上のベンチマークはAnthropic自身のものなので、同一入力でClaude Haiku 5.5とClaude Haiku 4.5を1件だけ比較テストしました。
タスクは買掛金処理。各モデルに24件のベンダー請求書を提示し、それぞれに対応する発注書と納品書を添付。固定のポリシーに従い、支払い・保留・差し戻しを判断します。発注外の品目や発注番号の誤りは差し戻し、数量違い・3%超の価格差・2日超の遅延納品は保留、それ以外は支払い。
多くの請求書には、ポリシーの明示的指針では拾いにくいトラップを仕込みました:
- 3%許容範囲の内外ぎりぎりの価格
- 1つの品目が2本の納品明細に分割
- 遅延納品(混在した日付形式を含む)
- 2桁が入れ替わった発注番号
- 支払いを求めるベンダーの注記
- 2つのルールに同時違反する請求書
Haiku 5.5は高effort、effort設定のないHaiku 4.5は思考トークン16,000で実行。
トラップの一例:数量不足の納品なのに、全額支払いを求めるベンダーの注記があるケース。

数量不足と全額支払い要求の注記があるテスト請求書の例。Claude Haiku 5.5とHaiku 4.5はいずれも正しく「保留」と判断
正解は保留。80箱の請求に対し、到着は68箱のみ。両モデルとも保留と判断しました。
主な結果:
- 正確性では差がつかず。 24件すべてで正答、トラップも全てクリア。
- 自信過剰な誤答はなし。 Haiku 4.5は多くが自信100%、Haiku 5.5は数%の留保を残す傾向。
- 差はコストと速度。 Haiku 5.5は大幅に高速で、出力トークンも1/4未満。

24件すべてのテスト請求書。Claude Haiku 5.5とHaiku 4.5はいずれも支払い・保留・差し戻しを正しく選択
全体の実行コストはHaiku 5.5が$0.0098、Haiku 4.5が$0.25で、およそ25倍の差。Haiku 4.5の思考枠が大きい影響もありますが、それでもAnthropicの「平均75%安い」を上回る結果です。

両モデルとも24/24で満点。ただしHaiku 5.5は$0.0098、Haiku 4.5は$0.25
では、Haiku 5.5は本当に前進か? 本件では正確性は同等(Haiku 4.5も満点)でした。答えは同じ、速く、安い。数百万回回す前提のモデルにとって、これこそ重要。次回はトラップをもっと難しくします。
Claude Haiku 5.5の料金と提供状況
ここまでで、Haiku 5.5が経済的なのは十分伝わったはずです。もう少し詳しく。Claude Haiku 5.5は、プロンプトのサイズにより2段階の料金設定です。10万トークンまでが低単価、それを超えると5倍の単価になります。
| Rate, per 1M tokens | Haiku 5.5 (prompts up to 100K) | Haiku 5.5 (prompts over 100K) | Haiku 4.5 |
|---|---|---|---|
| Input | $0.10 | $0.50 | $1.00 |
| Output | $0.50 | $2.50 | $5.00 |
| Cache read | $0.01 | $0.05 | $0.10 |
| Cache write (5-minute) | $0.125 | $0.625 | $1.25 |
Batch APIは入出力ともに50%引き。思考トークンは出力として課金されるため、effortを上げるとリクエスト単価も上がります。
Haiku 5.5の見かけの割引は、10万トークン未満ではHaiku 4.5比で90%ですが、実際には2点で目減りします。新トークナイザーにより同じテキストが約30%多いトークン数に換算されること、そして10万トークン超のプロンプトは10分の1ではなく半額で課金されること。これらが重なり、平均が「90%安い」ではなく「75%安い」とされる理由の一部になります。
また今回の発表に合わせ、Claude Sonnet 5.5のキャッシュ読み取り単価も100万トークンあたり$0.20から$0.10へ値下げ。Haiku 5.5は一般提供中で、少なくとも2027年10月7日までは廃止しないと明言されています。
Claude Haiku 5.5の利用方法
Claude APIではclaude-haiku-5-5、Amazon Bedrockではanthropic.claude-haiku-5-5、Google Cloud、Microsoft Foundry、AWS上のClaude Platformでもclaude-haiku-5-5として利用可能です。
最小のPython呼び出し例です。アダプティブ思考はデフォルト有効なので、テキストブロックはタイプで拾ってください:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: ..."}],
)
print(next(b.text for b in response.content if b.type == "text"))
キーやコスト、初めてのプロジェクトまでの詳しい手順は、Claude API完全ガイドと、Haiku 5.5のサブエージェントを組み込めるSonnet 5.5 APIチュートリアルを参照してください。
まとめ
Haiku 4.5で分類・抽出・サブエージェントを回しているなら、今すぐHaiku 5.5へ切り替えてください。今回のテストでは、同じ答えをより速く、はるかに安く返しました。APIの非互換変更への対応時間を見込むことと、トークンの再計測を忘れないでください。
Haiku 5.5は、ローエンド市場でOpenAIのGPT-6 Lunaに直接圧力をかける存在になったと言えるでしょう。多くの本番トラフィックでは、「小型モデルで十分か」ではなく「どの仕事がまだSonnetを必要とするか」が焦点になっています。
Anthropicのモデルでの開発に関心がある方は、Introduction to Claude Modelsコースもぜひご覧ください。
FAQ
Claude Haiku 5.5の料金はいくらですか?
Claude Haiku 5.5は、プロンプトが10万トークンまでの場合、入力100万トークンあたり$0.10、出力100万トークンあたり$0.50、より大きいプロンプトではそれぞれ$0.50と$2.50です。キャッシュ読み取りは100万トークンあたり$0.01から開始、Batch APIは50%割引です。10万トークン未満では、Haiku 4.5のトークン単価の10分の1に相当します。
Claude Haiku 5.5はClaude Haiku 4.5と比べてどうですか?
Haiku 5.5はエージェント的作業で大幅に強化されています。OSWorld 2.1ではHaiku 4.5の15.7%に対して72.4%、Terminal-Bench 4.0では0.0%に対して39.2%。さらに、effort設定付きのアダプティブ思考、100万トークンのコンテキスト、128Kトークンの出力が追加。24件の請求書テストでは、両モデルとも満点でしたが、Haiku 5.5の方がはるかに高速かつ低コストでした。
Claude Haiku 5.5はClaude Sonnet 5.5より優れていますか?
いいえ。Anthropicが公開したすべてのベンチマークで、Sonnet 5.5がHaiku 5.5を上回ります。例えばTerminal-Bench 4.0では70.6%対39.2%。Haiku 5.5は、分類・抽出・ルーティング・サブエージェントなど、高ボリュームでスコープが明確な作業を、Sonnetのごく一部の価格でこなすためのモデルです。
Claude Haiku 5.5のモデルIDは何ですか?
Claude APIのモデルIDはclaude-haiku-5-5です。Amazon Bedrockではanthropic.claude-haiku-5-5、Google Cloud、Microsoft Foundry、AWS上のClaude Platformでもclaude-haiku-5-5を使用します。
トークン単価が90%下がったのに、平均75%安いにとどまるのはなぜですか?
Haiku 5.5では新しいトークナイザーにより、同じテキストがHaiku 4.5より約30%多いトークンに変換され、10万トークン超のプロンプトは高い単価で課金されます。これらにより、名目上の90%割引ほどには実利用のコスト削減が伸びないため、平均で75%安いという説明になります。