Claude Haiku 5.5とは|Anthropicの最速・最安の小型モデル
Claude Haiku 5.5は、Anthropicがこれまでに出したHaikuの中で最も安く、最も速く、最も性能の高い小型モデルです。同じ作業を何千回も繰り返す処理や、応答の速さが求められる処理に向けて作られています。
Anthropicは用途として、要約、会話履歴の圧縮(コンパクション)、データベースへの問い合わせ、分類の4つを挙げています。いずれも1回の処理は軽いものの件数が多く、上位モデルで回すと費用がかさみやすい仕事です。
Claude 5.5ファミリーでの位置づけ
Claude 5.5ファミリーは、2026年9月23日公開のOpus 5.5から始まり、9月29日公開のSonnet 5.5、10月8日公開のHaiku 5.5の順でそろいました。Haiku 5.5はこの3つの中で最も軽く、単価も最も低いモデルです。
Haikuとしては、2025年10月公開のHaiku 4.5から約1年ぶりの新モデルになります。Opus 5.5とSonnet 5.5の公開時点では「数週間のうちに追加する」と予告されていたモデルで、これで5.5世代の3モデルがそろいました。
関連記事:Claude Opus 5.5とは?性能・料金とOpus 5から切り替える判断軸を整理
提供開始日と使える場所
Haiku 5.5は2026年10月8日の公開と同時に使えるようになりました。発表では、Claude Platform(API)に加えて、Amazon Web Services、Google Cloud、Microsoft Azureの各クラウドで提供されると案内されています。APIでのモデルIDはclaude-haiku-5-5です。
開発者向けの公式アカウントからは、Claude Codeでも使えるようになったと案内されています。上位モデルに主な作業を任せ、細かな調べものや要約をHaiku 5.5に分担させる使い方が想定されています。
先行企業の評価
公開前に試した企業からは、速さと精度の両方で前向きな評価が出ています。CRMソフトのHubSpotは、商談の集計などCRM作業を再現した評価で、小型モデルの中で過去最高となる92.8%を記録したと報告しています(出典: anthropic.com)。
プロジェクト管理ツールのAsanaは、自社のAIエージェント機能で使っているモデルと比べ、タスク完了までの待ち時間が30%以上短くなり、1回あたりの推論は最大2.5倍速くなったとしています。いずれも各社の評価環境での結果なので、自社の処理でも同じ傾向が出るかは試して確かめる必要があります。
Claude Haiku 5.5でできること|得意な処理と性能
Haiku 5.5が力を発揮するのは、範囲がはっきり決まった処理を大量に回す場面です。ここでは公式発表と、先行して試した企業のコメントをもとに、得意な処理を4つの面から見ていきます。
要約・分類・データ抽出の大量処理
最も分かりやすい用途は、文書の要約、問い合わせの分類、データの抽出といった反復処理です。1件ずつは単純でも、件数が数万件になると上位モデルでは費用が合わなくなります。
先行企業の評価では、金融情報サービスのAlphaSenseが、週に約800万回呼び出している文書への質問応答で400件を検証し、評価スコアがHaiku 4.5の0.76から0.84に上がったと報告しています。クラウドストレージのBoxは、Haiku 4.5より11ポイント高い評価を、約半分の待ち時間で得たとしています。
上位モデルのサブエージェント
Haiku 5.5は、Opus 5.5やSonnet 5.5の下で動くサブエージェント(親のAIから細かな作業を受け持つ補助役)としての使い方が推奨されています。全体の判断は上位モデルが担い、資料からの数字の抜き出しや下調べをHaiku 5.5が受け持つ分担です。
金融向けAIのRogoは、上位モデルが資料を組み立てる間に、Haiku 5.5が年次報告書から必要な売上の数字を抜き出す使い方を紹介しています。コーディングエージェントのDevinを提供するCognitionも、Opus 5.5を主役、Haiku 5.5を補助役にした構成を案内しています。
速さが要る顧客対応やブラウザ操作
Haiku 5.5はAnthropicのモデルの中で最も速く応答します(Opusの高速モードを除く)。そのため、待ち時間がそのまま顧客体験に響くチャットでの顧客対応や、画面を見ながら操作を進めるブラウザ操作に向いています。
パソコン操作の正確さを測るOSWorld 2.1(オフライン版)では72.4%を記録し、Haiku 4.5の15.7%から大きく伸びました(出典: anthropic.com)。操作の手数が多い作業でも単価が低いため、画面操作を伴う自動化の費用を抑えやすくなります。
effortで賢さと費用を調整できる
Haiku 5.5は、Haikuとして初めてeffort(推論にかける手間の量)を調整できるモデルです。公開されたグラフではLow・Medium・High・Xhigh・Maxの5段階が示されており、費用を抑えたい処理は低く、精度を優先したい処理は高く設定できます。既定の設定はMediumです。
Haiku 4.5はeffortに対応していなかったため、同じモデルのまま処理ごとに賢さと費用の釣り合いを変えられるのは大きな変化です。まず低めの設定で試し、出力の質が足りない処理だけ上げていく進め方が取りやすくなります。
Claude Haiku 5.5の使い方・始め方
Haiku 5.5は、すでにClaudeのAPIやクラウド経由でClaudeを使っている場合、モデルの指定を変えるだけで試せます。ここでは利用経路ごとに始め方を整理します。
APIで使う
Claude PlatformのAPIでは、リクエストのモデル名にclaude-haiku-5-5を指定します。Claude ConsoleのPlayground(ブラウザ上でプロンプトを試せる画面)でも、モデルを切り替えて出力を見比べられます。
Haiku 4.5から切り替える場合は、同じプロンプトと入力で両方の出力を並べ、品質と使用トークン数を比べてから本番の設定を変えるのが安全です。
effortの設定を決める進め方
effortは高くするほど精度が上がりやすい反面、使うトークンと待ち時間が増えます。処理ごとに適切な設定を決めるには、次の順で進めると判断しやすくなります。
- 本番で多い処理を20〜50件選び、正解や期待する出力を用意する
- まずLowを指定して実行し、正解と比べて品質を確認する(既定はMediumのため、Lowは明示して指定する)
- 品質が足りない処理だけMedium以上に上げ、改善の幅を見る
- 設定ごとのトークン数と待ち時間を記録し、費用と品質の釣り合う段階に決める
一律に高い設定にすると、Haiku 5.5を選んだ費用の利点が薄れます。低い設定で足りる処理を先に切り分けるのが、費用を抑えるうえでの近道です。
AIエージェントを「どう作り、どう育てるか」を、GiftX記事制作エージェントの実物で解説。
関連記事:Claude Opus 5 のプロンプト|消すべき指示と effort の決め方
SDKでコンピューター操作・ブラウザ操作を組み込む
Haiku 5.5の公開と同時に、ClaudeのPythonとTypeScriptのSDKにコンピューター操作とブラウザ操作の機能がベータとして組み込まれました。APIはClaudeがどこをクリックし何を入力したいかを返すだけなので、これまでは開発者が操作を繰り返す処理を自分で書く必要がありました。
SDKがその繰り返しを受け持つようになったことで、画面操作を伴う自動化を少ないコードで作れます。Anthropicは、速さと性能と単価の組み合わせから、Haiku 5.5がこうした操作に特に向いていると説明しています。
関連記事:Claude Computer Useとは?使い方・料金・安全性を整理
クラウド各社とClaude Codeで使う
社内のシステムがAWSやGoogle Cloud、Microsoft Azureの上で動いている場合は、それぞれのクラウドが提供するClaudeの窓口からHaiku 5.5を呼び出せます。契約や請求をクラウド側にまとめたい企業には、こちらの経路が合います。
Claude Codeでは、主な作業を上位モデルに任せ、下調べや要約をHaiku 5.5に任せる分担が想定されています。サブエージェントのモデルを軽いものにすると、長い作業での費用を抑えやすくなります。
関連記事:Claude Codeのモデル一覧と切り替え方|Opus 5.5・Sonnet 5の使い分け
Max・Teamの月額APIクレジットで試す
Haiku 5.5と同時に、MaxプランとTeamプランに月額のAPIクレジットが付くようになりました。Max 5xは月100ドル、Max 20xは月200ドル、Teamは席数に応じて最大500ドルで、数日かけて順次配られます(2026年10月時点、出典: claude.com)。
クレジットは、Claudeの有料プランとClaude Consoleの組織をひも付けると毎月入り、Messages APIやバッチAPI、Claude Agent SDKで使えます。対話型のClaude Codeや各クラウド経由の利用には使えず、使い切れなかった分は翌月に繰り越されません。
関連記事:Claude Maxとは?料金・使用量の上限とProとの違い、選び方を整理
Claude Haiku 5.5の料金|10万トークンを境に単価が変わる
Haiku 5.5の料金は、1回のリクエストで送る入力が10万トークン以下か、それを超えるかで単価が変わります。下表は、100万トークンあたりの単価をHaiku 4.5・Sonnet 5.5と並べたものです(2026年10月時点、出典: anthropic.com)。10万トークン以下の処理なら、Haiku 4.5の10分の1の単価で使えます。
| 項目 | Haiku 5.5(10万トークン以下) | Haiku 5.5(10万トークン超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 入力 | 0.10ドル | 0.50ドル | 1.00ドル | 2.00ドル |
| 出力 | 0.50ドル | 2.50ドル | 5.00ドル | 10.00ドル |
| キャッシュ書き込み | 0.125ドル | 0.625ドル | 1.25ドル | 2.50ドル |
| キャッシュ読み取り | 0.01ドル | 0.05ドル | 0.10ドル | 0.10ドル |
Anthropicによると、Haiku 4.5に届いていたリクエストの約90%は10万トークン以下でした。10万トークン以下では90%、超える場合でも50%安くなり、後述するトークン数の増加を差し引いた実際の費用は平均で約75%の削減になるとしています。
具体的な金額で比べてみます。1件あたり入力2,000トークン、出力300トークンの分類を10万件処理すると、Haiku 5.5は入力20ドルと出力15ドルで合計約35ドルです。同じ処理はHaiku 4.5で約350ドル、Sonnet 5.5で約700ドルかかります(2026年10月時点の単価で計算)。実際にはトークン数がやや増えるため、この試算より少し高くなる点に注意してください。
同じ発表で、Sonnet 5.5のキャッシュ読み取りの単価も100万トークンあたり0.20ドルから0.10ドルへ半分に下がりました(2026年10月時点)。キャッシュ読み取りはエージェント処理で使うトークンの大きな割合を占めるため、Sonnet 5.5もほとんどのエージェント処理で約20%安くなります。
Claude Haiku 5.5とHaiku 4.5の違い
Haiku 5.5とHaiku 4.5は、どちらも速さと安さを重視した小型モデルですが、性能、料金、調整できる項目が大きく変わりました。下表は、公式に公表された評価結果と仕様を、知識業務、パソコン操作、推論、コーディングの観点で並べたものです(出典: anthropic.com)。数字の差が大きい項目ほど、これまで小型モデルには任せにくかった処理を任せられるようになったと読めます。
| 観点 | Haiku 5.5 | Haiku 4.5 |
|---|---|---|
| 知識業務(GDPval-AA v2.1) | 1620 | 735 |
| パソコン操作(OSWorld 2.1 オフライン版) | 72.4% | 15.7% |
| 分野横断の推論(Humanity's Last Exam・ツールなし) | 45.9% | 10.2% |
| エージェント型コーディング(Terminal-Bench 4.0) | 39.2% | 0.0% |
| 図表の読み取り(Chartography・ツールなし) | 46.4% | 6.4% |
| effortの調整 | できる | できない |
| コンテキスト長 | 100万トークン | 20万トークン |
| 入力単価(10万トークン以下・100万トークンあたり) | 0.10ドル | 1.00ドル |
たとえばパソコン操作の評価は15.7%から72.4%へ伸びており、Haiku 4.5では途中で止まりがちだった画面操作の作業を、Haiku 5.5なら最後まで任せられる場面が増えます。安全面でも、不適切な振る舞いや悪用への協力がHaiku 4.5より大幅に減ったと報告されています。
関連記事:Claudeのモデルを比較|Fable・Opus・Sonnet・Haikuの違いと選び方
Claude Haiku 5.5とSonnet 5.5・Opus 5.5の違いと使い分け
同じClaude 5.5ファミリーでも、3つのモデルは得意な仕事の幅と単価が大きく異なります。下表は、公式の位置づけと料金をもとに、向いている処理を並べたものです。判断の難しさと作業の長さに応じて、上位モデルと小型モデルを組み合わせるのが基本になります。
| モデル | 向いている処理 | 入力・出力の単価(100万トークンあたり) |
|---|---|---|
| Haiku 5.5 | 要約、分類、データ抽出、サブエージェント、即答が要る顧客対応 | 0.10ドル・0.50ドル(10万トークン以下) |
| Sonnet 5.5 | 日常的な開発や分析、速さと賢さの両立が要る作業 | 2ドル・10ドル |
| Opus 5.5 | 長時間のエージェント作業、難しい判断を伴う知識業務 | 4ドル・20ドル |
Anthropic自身も、複雑なエージェント型コーディングにはSonnet 5.5とOpus 5.5のほうが適していると明記しています。Terminal-Bench 4.0ではSonnet 5.5の70.6%に対してHaiku 5.5は39.2%で、難しい作業ほど差が開きます(出典: anthropic.com)。
一方で、範囲が決まった処理ならHaiku 5.5の差は小さく、知識業務のGDPval-AAではSonnet 5.5の1840に対して1620でした。OpenAIの軽量モデルGPT-6 Lunaとの比較も公表されており、GDPval-AAではGPT-6 Lunaの1437、パソコン操作では48.9%をいずれも上回っています。全体の設計と判断は上位モデル、件数の多い作業はHaiku 5.5という分担にすると、品質を保ったまま費用を抑えられます。
たとえば問い合わせ対応なら、問い合わせの分類と回答の下書きをHaiku 5.5に任せ、返金や契約変更のような例外の判断だけをSonnet 5.5やOpus 5.5に回す構成が考えられます。件数の大半を占める定型の問い合わせを安いモデルで処理できるため、全体の費用を大きく下げられます。
全国8,000人調査で、AIの活用方法によって生産性向上に約3.8倍の差が生まれることが判明。
関連記事:Claude Sonnet 5.5とは?できること・料金とOpus 5.5の違い
Claude Haiku 5.5に切り替える前の注意点
Haiku 5.5は単価が大きく下がった一方で、使い方によっては想定ほど費用が下がらない場合があります。切り替えの前に、次の4点を確かめておくと安心です。
1つの作業で使うトークン数がやや増える
Haiku 5.5は、Sonnet 5.5やOpus 5.5と同じ系統の新しいトークナイザー(文章をトークンに区切る仕組み)を使っています。そのため、同じ作業でもHaiku 4.5より使うトークン数がやや多くなります。単価の差だけで試算すると、実際の請求額と食い違うことがあります。
10万トークンを超える入力は単価が5倍になる
10万トークンを超えるリクエストは、入力・出力とも10万トークン以下の5倍の単価になります。長い資料をまとめて読ませる処理が多い場合は、資料を分けて送るか、キャッシュを使って読み取り単価を下げる設計にすると費用を抑えられます。
100万トークンまで入るが、長い入力ほど費用がかさむ
Haiku 5.5が一度に扱える文章の長さ(コンテキスト長)は100万トークン、1回の出力は最大12.8万トークンで、Haiku 4.5の20万トークンから5倍に広がりました(2026年10月8日時点のAnthropic公式のモデル一覧)。長い資料を分けずに渡せるようになった一方で、10万トークンを超えるリクエストは、前の項目のとおり全体の単価が5倍になります。長い入力を扱う処理は、入れられる量ではなく費用で上限を決めておくと、想定外の請求を防げます。
セキュリティ診断のような用途には制限がある
Haiku 5.5のサイバーセキュリティ関連の安全対策は、Haiku 4.5より厳しく設定されています。防御側の作業は幅広く受け付けますが、侵入テストのように攻撃にも使える手法は止められます。こうした業務で使う場合は、Anthropicの審査制プログラムへの申請が必要です。
大量の要約・分類をLLMに任せた自社事例
GiftXでは、サービスに集まるユーザーレビューの要約、感情分析、分類をLLM APIで一括処理しています。以前はレビューを1件ずつ読んで手作業でタグを付け、カテゴリ別に集計し、改善点を拾ってExcelにまとめていました。
現在は、レビューのデータを渡すとAIが要約から分類、改善点の抽出までをまとめて行い、100件あたり約5時間かかっていた作業が約10分になりました。人が見るのは、AIが挙げた改善点の妥当性の確認だけです。
こうした件数の多い処理は、Haiku 5.5のような小型モデルで単価を下げやすい典型です。一方で、分類の基準が細かい処理ほど、モデルを変えたときに判定がずれることがあります。切り替える際は、過去の分類結果と新しいモデルの出力を並べ、ずれの出た項目を確かめてから移すのが確実です。
Claude Haiku 5.5のよくある質問
Claude Haiku 5.5はいつから使えますか?
2026年10月8日の公開と同時に使えるようになりました。Claude PlatformのAPIのほか、Amazon Web Services、Google Cloud、Microsoft Azureの各クラウドと、Claude Codeで利用できます。APIではモデル名にclaude-haiku-5-5を指定します。
Claude Haiku 5.5の料金はいくらですか?
入力10万トークン以下のリクエストでは、100万トークンあたり入力0.10ドル、出力0.50ドルです。10万トークンを超えると、入力0.50ドル、出力2.50ドルに上がります(2026年10月時点)。
Claude Haiku 5.5はどんな処理に向いていますか?
要約、分類、データ抽出のように範囲が決まった処理を大量に回す用途と、上位モデルの下で細かな作業を受け持つサブエージェントに向いています。応答が速いため、チャットでの顧客対応やブラウザ操作にも使えます。複雑なコーディングには、Sonnet 5.5やOpus 5.5のほうが適しています。
Haiku 4.5から切り替えると費用はどれくらい下がりますか?
Anthropicによると、平均で約75%下がります。10万トークン以下のリクエストでは単価が90%下がりますが、新しいトークナイザーで使うトークン数がやや増えるため、実際の削減幅は処理の内容で変わります。切り替える前に、自社の処理で使用量を測ると確実です。
Claude Haiku 5.5のコンテキスト長はどれくらいですか?
Claude Haiku 5.5のコンテキスト長は100万トークンで、1回の出力は最大12.8万トークンです(2026年10月8日時点のAnthropic公式のモデル一覧)。前モデルのHaiku 4.5の20万トークンから5倍に広がりました。ただし10万トークンを超えるリクエストは単価が5倍になるため、長い入力を扱う場合は費用もあわせて見積もってください。
MaxやTeamの月額APIクレジットでHaiku 5.5を使えますか?
使えます。月額のAPIクレジットはClaude Platformで使えるすべてのモデルが対象で、Haiku 5.5も含まれます。ただし、対話型のClaude Codeや、AWSなど各クラウド経由の利用には充てられません。
まとめ
Claude Haiku 5.5は、Anthropicが2026年10月8日に公開した小型モデルで、Haiku 4.5より平均で約75%安く、知識業務やパソコン操作の評価も大きく伸びました。10万トークン以下の入力なら、100万トークンあたり入力0.10ドルで使えます(2026年10月時点)。
向いているのは、要約や分類のように範囲が決まった処理を大量に回す用途と、上位モデルの下で働くサブエージェントです。複雑なコーディングや難しい判断はSonnet 5.5やOpus 5.5に任せ、件数の多い作業をHaiku 5.5に回す分担にすると、品質を保ったまま費用を抑えられます。
切り替える際は、トークン数の増加と10万トークンを超えたときの単価を踏まえ、自社の処理で品質と費用を測ってから移すと安心です。
小型モデルを業務に組み込む段階では、GiftXが1業務単位のAIエージェント構築を伴走支援しています。詳細は AIエージェント構築支援サービス をご覧ください。
AI活用の伴走支援をご検討の方へ
本記事で紹介したAIエージェントの活用に向けて、自社の業務でも具体的に進めたい・相談したいとお考えの方は、ぜひGiftX AIエージェント構築支援までお問い合わせください。
GiftX AIエージェント構築支援では、貴社の業務に合わせて1業務単位のスモールスタートから本番運用まで、AIエージェント構築をワンストップで支援します。ユースケースの洗い出しから、PoC、本番運用、社内ナレッジ化まで伴走します。
AI活用にご関心のある方は、ぜひ一度ご相談ください。
▶ GiftX AIエージェント構築支援の詳細・お問い合わせはこちら