コンテンツへスキップ

media AI活用の最前線

Claude Haiku 5.5とは|料金は10分の1・Sonnetとの違い

Claude Haiku 5.5とは|料金は10分の1・Sonnetとの違い

2026年10月8日時点で、Claude Haiku 5.5はClaude API・AWS・Google Cloud・Azure・GitHub Copilot・Claudeアプリ(無料プラン含む)で使えます。Anthropicが10月7日(米国時間)に公開した小型モデルで、API料金は10万トークン以下のリクエストなら入力$0.10・出力$0.50(100万トークンあたり)とHaiku 4.5の10分の1、実際の利用では平均で約75%安くなるとAnthropicは説明しています。コンテキストは1Mトークン、出力は最大12.8万トークンで、Haikuクラスで初めて思考の深さを選ぶeffort設定に対応しました。

この記事では、Anthropicの発表と公式ドキュメント(料金・モデル一覧・What’s new・移行ガイド・プロンプトの手引き)、GitHubのchangelog、ITmediaの報道をもとに、料金・仕様・性能・使いどころ・移行時の注意点をまとめます。日本語の性能評価や日本円の公式価格は10月8日時点で公式発表にないため書いていません。最終更新:2026年10月8日。

Claude Haiku 5.5とは|10月7日に提供開始、最速・最安の小型モデル

Claude Haiku 5.5は、Anthropicが2026年10月7日に提供開始した小型モデルです。同社は「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけ、要約・分類・コンパクション(会話履歴の圧縮)・データベース照会のような大量の定型処理と、Opus 5.5やSonnet 5.5の下で動くサブエージェントを主な用途に挙げています。通常速度では同社のモデルで過去最速(Fast ModeのOpusは除く)で、カスタマーサポートの即時応答やブラウザ操作にも向くとしています。9月のOpus 5.5・Sonnet 5.5に続くClaude 5.5世代の3本目で、モデルIDはclaude-haiku-5-5です。

図: Claude Haiku 5.5(10月7日に提供開始)。要約・分類・コンパクションの処理を受け、Claude API・AWS・Google Cloud・Azure・GitHub Copilot・Claudeアプリ(無料プラン含む)で使える最速・最安の小型モデル

提供先は発表当日から全プラットフォームです。Claude APIのほか、AWS(Amazon BedrockとClaude Platform on AWS)・Google Cloud・Microsoft Foundry(Azure)で使え、ITmediaによるとClaudeアプリでは無料プランを含む全プランで選べます。GitHub Copilotでも同日に一般提供が始まり、Claude Codeは同日のv2.1.293でHaiku 5.5をAPI上の既定のHaikuモデルとして追加しました。上位モデルの料金と性能はClaude Opus 5.5とは|料金・性能・Opus 5との違いにまとめています。

料金|Haiku 4.5の10分の1、平均で約75%安い

料金はプロンプトが10万トークン以下か、それを超えるかで2段階です。10万トークン以下は10分の1、超えると半額になります。Anthropicによると、Haiku 4.5へのリクエストの約90%は10万トークン以下でした。一方で、Haiku 5.5はSonnet 5.5やOpus 5.5と同じ新しいトークナイザーを使うため、同じ文章で約30%多いトークン数になります。この2つを合わせた実際の利用コストが、平均で約75%減という説明です。

図: 100万トークンあたりの料金比較。Haiku 5.5は入力$0.10・出力$0.50、Haiku 4.5は入力$1.00・出力$5.00。10万トークン以下は10分の1

100万トークンあたりHaiku 5.5(10万トークン以下)Haiku 5.5(10万トークン超)Haiku 4.5Sonnet 5.5
入力(100万トークン)$0.10$0.50$1.00$2.00
出力(100万トークン)$0.50$2.50$5.00$10.00
キャッシュ書き込み$0.125$0.625$1.25$2.50
キャッシュ読み取り$0.01$0.05$0.10$0.10(10月7日に$0.20から半額)

出典はAnthropicの発表と料金ページ(2026年10月8日取得)。バッチ処理の割引や為替は含みません。

規模感を置いた試算をひとつ。1日1万件の問い合わせを分類する処理で、1件あたり入力2,000トークン・出力100トークン(いずれも10万トークン以下)とすると、1日の入力は2,000万トークン、出力は100万トークンです。Haiku 5.5なら入力$2.00と出力$0.50で1日$2.50、30日で$75。同じ条件のHaiku 4.5は1日$25、30日で$750です。実際にはトークナイザーの差で5.5側のトークン数が約30%増えるため、差は公式の言う約75%減に近づきます。

仕様|1Mコンテキスト・12.8万トークン出力・effort対応

Haiku 4.5から大きく変わったのは、コンテキストウィンドウ(20万→1M)、最大出力(6.4万→12.8万トークン)、そして適応型の思考とeffort設定です。effortはlow・medium・high・xhigh・maxの5段階で、Claude APIとClaude Codeの既定はmediumです。lowは会話や短いツール呼び出し、大量の単純処理向き、highは知識作業や長いエージェント処理向きと公式の手引きにあります。

項目Claude Haiku 5.5Claude Haiku 4.5
モデルIDclaude-haiku-5-5claude-haiku-4-5
コンテキストウィンドウ1Mトークン20万トークン
最大出力12.8万トークン6.4万トークン
思考適応型(既定で有効)・effortで調整手動の思考予算(budget_tokens)
既定のeffortmedium設定なし
知識のカットオフ2026年6月公式のモデル一覧を参照
提供終了2027年10月7日以降公式の非推奨一覧を参照

出典はClaude Platform Docsのモデル一覧とWhat’s new(2026年10月8日取得)。コンテキスト長は他社モデルとの比較を主要AIモデル コンテキスト長 横断比較に、effort設定の考え方はClaude Opus 5の使い方|effort設定と1M活用にまとめています。

性能|ベンチマークでHaiku 4.5を大きく上回り、GPT-6 Lunaとも競る

Anthropicが公開したベンチマークでは、Haiku 5.5はほぼ全項目でHaiku 4.5を大きく上回りました。コンピュータ操作のOSWorld 2.1(オフライン版)は72.4%で、OpenAIのGPT-6 Luna(48.9%)を上回り、Sonnet 5.5(83.9%)には届きません。知識作業のGDPval-AA v2.1は1620(Haiku 4.5は735、Sonnet 5.5は1840)、Humanity’s Last Examはツールなしで45.9%です。一方、エージェント型コーディングのTerminal-Bench 4.0は39.2%で、Sonnet 5.5の70.6%とは差があります。

図: OSWorld 2.1(コンピュータ操作・オフライン版)の比較。Haiku 4.5 15.7%、GPT-6 Luna 48.9%、Haiku 5.5 72.4%、Sonnet 5.5 83.9%

ベンチマークHaiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5
GDPval-AA v2.1(知識作業)162073514371840
OSWorld 2.1(コンピュータ操作・オフライン版)72.4%15.7%48.9%83.9%
Humanity’s Last Exam(ツールなし)45.9%10.2%記載なし56.9%
Terminal-Bench 4.0(エージェント型コーディング)39.2%0.0%16.4%70.6%
Chartography(図表の読み取り・ツールなし)46.4%6.4%29.1%61.6%

出典はAnthropicの発表(2026年10月7日)。評価方法の詳細はHaiku 5.5のSystem Cardにあります。初期テストの顧客の声として、Asanaは「現行モデルと比べてタスク完了の遅延が30%以上減り、1ターンあたりの推論が最大2.5倍速い」、HubSpotはCRMタスクの評価で「小型モデルで過去最高の92.8%」、Boxは「Haiku 4.5より11ポイント高く、遅延は約半分」と報告しています。

使いどころ|Sonnet 5.5・Opus 5.5との使い分け

Anthropic自身が線を引いています。Haiku 5.5に向くのは、大量の定型処理(要約・分類・抽出・ルーティング)、サブエージェント、サポートの即時応答、ブラウザ操作のような、範囲が限られていて量が多い仕事です。複雑なエージェント型コーディングや長く続く自律作業はSonnet 5.5・Opus 5.5に向くとしており、Terminal-Bench 4.0の差(39.2%と70.6%)がその根拠です。範囲の限られた処理は小型、複雑な自律作業は大型、という分け方になります。

図: Haiku 5.5に向く(大量の定型処理・サブエージェント・サポートの即時応答・ブラウザ操作)とSonnet 5.5・Opus 5.5に向く(複雑なエージェント型コーディング・長く続く自律作業)。範囲の限られた処理は小型、複雑な自律作業は大型

法人の業務に当てはめると、問い合わせメールの一次分類、議事録や日報の要約、社内ドキュメントからの項目抽出、ログの監視と通知文の生成、チャットボットの一次応答が候補です。これまで「Claudeで回すとコストが合わない」と判断していた処理を、Haiku 5.5の単価で再計算する価値があります。Opus 5.5やSonnet 5.5が親として計画し、Haiku 5.5のサブエージェントが調べ物や抽出を担う構成は、Cognition(Devin)が「Opus 5.5を主担当、Haiku 5.5を補佐にしてFrontierCodeの66.2を保ちながらコストと遅延を削った」と報告しているとおり、公式が想定する使い方です。

この記事の内容を社内で使うなら

要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。

生成AI 料金・プラン早見表 2026年10月版無料で受け取る →AI顧問に相談する(30分・無料)→

提供先|Claude API・クラウド3社・GitHub Copilot・Claude Code・Claudeアプリ

利用できる場所を10月8日時点の公式情報でまとめます。

提供先状況(2026年10月8日時点)
Claude API(Claude Platform)提供中。モデルIDはclaude-haiku-5-5。PythonとTypeScriptのSDKにブラウザ操作とコンピュータ操作のツールセットがβ版で追加
Amazon Bedrock・Claude Platform on AWS提供中(ID: anthropic.claude-haiku-5-5/claude-haiku-5-5)
Google Cloud提供中(ID: claude-haiku-5-5)
Microsoft Foundry(Azure)提供中(ID: claude-haiku-5-5)
GitHub Copilot一般提供。Copilot Pro・Pro+・Max・Business・Enterpriseが対象。VS Code・Visual Studio・Copilot CLI・JetBrains・Xcode・Eclipse・github.com・モバイルのモデル選択に順次表示。従量課金はプロバイダー定価
Claude Codev2.1.293(10月8日)でAPI上の既定のHaikuモデルに
Claudeアプリ(claude.ai)無料プランを含む全プランで選択可能(ITmediaの報道)

GitHub側は「初期テストで多くのコーディングタスクにおいてSonnet 5と同等の結果を、より少ないトークンとステップで出した」と説明しています。Business・Enterpriseでは管理者のモデルポリシーで有効・無効を管理できます。

同時発表|Sonnet 5.5のキャッシュ読み取りが半額、Max・TeamにAPIクレジット

Haiku 5.5と同じ日に、2つの値下げ・特典が発表されました。1つ目はSonnet 5.5のプロンプトキャッシュ読み取り料金で、100万トークンあたり$0.20から$0.10に下がりました(基本の入力単価の0.05倍)。エージェント型の処理ではキャッシュ読み取りがトークン消費の大半を占めるため、多くの作業でSonnet 5.5のコストが約20%下がるとAnthropicは説明しています。2つ目はClaude MaxとTeamプランの契約者向けの月次APIクレジットです。

プラン月次クレジット
Max 5x$100
Max 20x$200
TeamStandardシート1席$20・Premiumシート1席$100を合算、上限$500

対象はClaude API・Claude Managed Agents・Claude Agent SDK・プレイグラウンドで、Claude Codeとアプリの追加利用、Bedrock・Google Cloud・Foundry経由の利用には使えません。請求サイクルごとに付与され、繰り越しはなし、新規契約者は7日後から受け取れます。受け取りにはclaude.aiの設定からConsoleの組織をひも付けます。

Haiku 4.5から移行する時の確認点

Anthropicは「Haiku 4.5向けに書いたコードはHaiku 5.5で壊れることがある」と明記し、移行ガイドを公開しています。破壊的変更は5つで、手動の思考予算budget_tokensは400エラー、temperatureなどの指定もエラー(temperature・top_p・top_kは省略する)、アシスタント側のprefillもエラー、コンピュータ操作はcomputer_toolset_20260801への切り替えが必要、過去のターンを書き換えると思考ブロックが無効になる、の5点です。

図: Haiku 4.5から移行する時の確認点。budget_tokensは400エラー、temperatureなどの指定もエラー、応答が思考ブロックで始まることがある、同じ文章で約30%多いトークン数。effortで思考の深さを調整

挙動の変化も押さえておきます。適応型の思考が既定で有効なので応答が思考ブロックで始まることがあるため、最初のブロックを答えとして読むコードはtypeで選び直します。思考の文章は既定では返らず、要約を受け取るにはthinking.displayを”summarized”にします。トークナイザーが変わり同じ文章で約30%多いトークン数になるので、max_tokensとコスト見積もりを数え直します。思考の量はeffortで思考の深さを調整します(lowが最も安く速い)。検索ツールを渡す時は今日の日付をプロンプトに入れると、最新の結果に基づいて答えやすくなると公式の手引きにあります。

安全性|サイバー系のセーフガードは4.5より厳しく、プロンプトインジェクション耐性は向上

Anthropicは、整合性の評価のほぼ全項目でHaiku 4.5から改善し、悪用への協力が減ったとしています。サイバーセキュリティのセーフガードはHaiku 4.5より厳しく、最近の他モデルよりはやや緩い設定で、防御的な作業は広く許す一方、ペネトレーションテストなど攻撃側が使いやすい手法はブロックします。生物学分野はSonnet 5・Sonnet 5.5・Opus 5と同じ基準です。ブロックされた時に別モデルへ振り替える仕組みはなく、APIではstop_reasonが”refusal”で返るため、クライアント側で扱う必要があります。

ITmediaがSystem Cardから報じた数字では、Gray Swanのベンチマークでプロンプトインジェクション攻撃が15回の試行で成功する確率がHaiku 4.5の83.2%から7.1%に下がった一方、問題のない依頼を断る過剰な拒否はテストした中で最も多く、ハルシネーションはHaiku 4.5と同程度とされています。システムプロンプトなしのAPI利用では一部の会話で不適切な応答が出やすいため、API経由で使う開発者には独自の対策を加えるよう求めています。

よくある質問

Claude Haiku 5.5は無料で使えますか?

ITmediaの報道によると、Claudeアプリでは無料プランを含む全プランで選べます。APIは従量課金で、10万トークン以下なら入力$0.10・出力$0.50(100万トークンあたり)です。MaxとTeamの契約者には月次のAPIクレジットが付きます。

Haiku 4.5のコードはそのまま動きますか?

動かない場合があります。budget_tokens・temperatureなどのサンプリング指定・アシスタントのprefill・旧いコンピュータ操作ツール・過去ターンの書き換えの5点がエラーや無効化の対象です。既存のプロンプト自体は、手引きによると変更なしでも良好に動くとされています。

10万トークンを超えると料金はどうなりますか?

入力$0.50・出力$2.50(100万トークンあたり)に上がり、Haiku 4.5の半額にとどまります。Anthropicによると、Haiku 4.5への要求の約90%は10万トークン以下でした。

Sonnet 5.5とどちらを選べばよいですか?

範囲が限られた大量処理と速度重視の用途はHaiku 5.5、複雑なエージェント型コーディングや長い自律作業はSonnet 5.5・Opus 5.5が公式の推奨です。Sonnet 5.5はキャッシュ読み取りの半額で、エージェント用途のコストが約20%下がっています。

GitHub CopilotやClaude Codeで使えますか?

GitHub CopilotはCopilot Pro以上の有料プランで一般提供(順次展開・従量課金)、Claude Codeはv2.1.293でAPI上の既定のHaikuモデルになりました。

日本語の性能は公開されていますか?

2026年10月8日時点で、Anthropicの発表とSystem Cardの報道に日本語に特化した評価は示されていません。社内の定型処理で使う場合は、自社の実データで分類や要約の精度を測ってから切り替えるのが安全です。

まとめ

  • Claude Haiku 5.5は10月7日に提供開始。10万トークン以下は入力$0.10・出力$0.50でHaiku 4.5の10分の1、実利用では平均で約75%安い
  • 1Mコンテキスト・12.8万トークン出力・effort対応。知識のカットオフは2026年6月
  • 用途は要約・分類・コンパクション・サブエージェント・即時応答。複雑な自律作業はSonnet 5.5・Opus 5.5
  • 同時にSonnet 5.5のキャッシュ読み取りが半額、MaxとTeamに月次APIクレジット
  • Haiku 4.5からの移行は破壊的変更5つ。トークン数が約30%増えるので見積もりを数え直す

Claudeの基本はクロードAI(Claude)とは|アンソロピックの生成AIで整理しています。

参考・出典

いずれも2026年10月8日に参照。

この記事の内容を社内展開する方へ: 生成AI 料金・プラン早見表 2026年10月版(無料・PDF 35ページ+Excel) をダウンロードできます。

佐藤傑
この記事を書いた人 佐藤傑

株式会社Uravation 代表取締役CEO/生成AIエバンジェリスト。法人向けAI研修・コンサルティングを手がけ、日経・SBクリエイティブ・GMO等のメディアで生成AIについて執筆。

執筆・監修:佐藤傑/下書き・図版・機械検査:当社のAI社員(人が確認してから公開しています)。記事の作り方と検査の方針

この記事をシェア

Contact お問い合わせ

30分の無料相談では、いま時間を取られている業務を伺い、稼働中のAI社員62体の事例の画面と一緒に近い進め方をお見せします。
売り込みはしません。

Claude Code 個別指導(1対1・12セッション)をご希望の方はこちら、Codex 個別指導はこちらから別途お申し込みください

Claude Code 個別指導 無料相談