Anthropicは2026年10月7日、小型モデルの新版「Claude Haiku 5.5」を公開しました。Anthropicは「これまでに出した小型モデルの中で、最も安く、最も速く、最も高性能」と説明しています。API料金は、入力が100万トークンあたり$0.10から。前の版のHaiku 4.5は$1だったので、条件によっては10分の1です。
トークンとは、AIが文章を処理するときの単位です。この記事では、公式の数字を確かめたうえで、情シスが気にする料金、使える場所、切り替えの注意を順に書きます。
Claude Haiku 5.5とは何か
Haikuは、Claudeのうち小型で速いモデルです。今回の5.5について、Anthropicのモデル一覧は「分類、抽出、振り分けなど、大量で遅れが許されない作業向け」と説明しています。Claude 5.5の系列では、Opus 5.5、Sonnet 5.5と並ぶ位置づけです。
AnthropicのClaude Haikuのページ。Haiku 5.5が10月7日の新着出典: Anthropic(引用)
Anthropicは、Haiku 4.5に比べて、コード作成、ツールの利用、パソコン操作、エージェント(自分で手順を進めるAI)で「大きく前進した」としています。数字での比較は、この記事では扱いません。性能は用途で変わるため、自社の作業で試して判断してください。
主な仕様は次のとおりです。
| 項目 |
内容(Anthropic公式) |
| API上のモデル名 |
claude-haiku-5-5 |
| 一度に読める量(コンテキスト) |
100万トークン |
| 最大の出力 |
12.8万トークン |
| 知識の期限 |
2026年6月 |
| 速さ(Anthropic内の相対比較) |
現行のモデルで最速 |
| 提供の終了時期 |
2027年10月7日より早くはならない |
「努力量(effort)」の設定にも対応します。課題ごとに、考える量と費用を調整するための設定です。Anthropicはこの設定を、Haikuで初めてだと説明しています。
料金はいくらか
API料金は、1回に送る文章(プロンプト)の長さで変わります。100万トークンあたりの金額は次のとおりです(米ドル、2026年10月8日に確認)。
| 区分 |
入力 |
出力 |
キャッシュの読み出し |
バッチ処理(入力・出力) |
| Haiku 5.5(100,000トークンまで) |
$0.10 |
$0.50 |
$0.01 |
$0.05・$0.25 |
| Haiku 5.5(100,000トークン超) |
$0.50 |
$2.50 |
$0.05 |
$0.25・$1.25 |
| Haiku 4.5 |
$1 |
$5 |
$0.10 |
$0.50・$2.50 |
| Sonnet 5.5 |
$2 |
$10 |
$0.10 |
$1・$5 |
キャッシュとは、同じ前置きの文章を使い回すと安くなる仕組みです。バッチ処理は、すぐの返答が要らない大量の依頼をまとめて送る方法で、50%引きになります。Anthropicは、キャッシュで最大90%、バッチで50%の節約ができるとしています。
費用のめやす(編集部の計算)
次の条件で、1か月の費用を計算しました。公式の単価を掛けただけの試算で、実際の請求とは異なる場合があります。
- 条件: 100万件の依頼。1件あたり入力2,000トークン、出力500トークン。すべて100,000トークン以内(MTokは100万トークン。入力は計2,000 MTok、出力は計500 MTok)
- Haiku 5.5: 入力2,000 MTok × $0.10 = $200、出力500 MTok × $0.50 = $250、合計$450
- Haiku 4.5: 入力2,000 MTok × $1 = $2,000、出力500 MTok × $5 = $2,500、合計$4,500
料金ページは、Claude 4.7以降のモデルでは新しい文字の区切り方(トークナイザー)により、同じ文章でも約30%多くのトークンになると注記しています。切り替え後の実際の使用量は、自社のデータで測って確かめてください。
米国内だけで処理する設定(inference_geo: "us")を使うと、Claude 4.6以降のモデルでは全料金が1.1倍になります。AmazonのBedrockとGoogle Cloudは、それぞれ別の料金表です。
どこで使えるか
Anthropicの発表で確認できる提供先は次のとおりです。
- claude.ai(Web、iOS、Android): Free、Pro、Max、Team、Enterpriseの利用者が選べます
- Claude Platform(API)
- Amazon Bedrock、Claude Platform on AWS
- Google Cloud
- Microsoft Foundry
- Claude Code
GitHub Copilotでの提供も始まりました。対象プランや管理者の設定は、別の記事にまとめています。
日本での提供条件は、発表には書かれていません。日本語での性能、日本のリージョン、日本円での請求の扱いも書かれていません。
Haiku 4.5からの切り替えで壊れるもの
Anthropicのリリースノート(2026年10月7日)は、Haiku 4.5向けに書いたコードがHaiku 5.5で動かなくなる場合があるとしています。
- 手動の拡張思考(budget_tokens)を指定すると、400エラーが返ります
- 適応的な思考が既定で有効になります。返答の先頭に思考のブロック(thinking)が付くことがあり、同じ文章でもトークン数が増えます
影響する会社・しない会社
- 影響する: Claude APIやBedrock、Google Cloud、Microsoft FoundryでHaiku 4.5以前の小型モデルを使い、問い合わせの振り分け、情報の抜き出し、要約などを大量に回している会社です。費用が下がる可能性があります
- 影響する: GitHub Copilot Business・Enterpriseを使う会社です。新モデルが自動で有効になる設定の場合、開発者が選べるモデルが増えます
- 影響する: Haiku 4.5を決まった形式の出力で使っていて、budget_tokensなどの設定を入れている会社です。切り替え時にエラーが出ます
- 影響しない: Claudeを使っていない会社、または大型モデルだけを少量使っている会社です。すぐの対応は要りません
- 影響しない: モデル名を固定していて、自分で書き換えない限り切り替わらない会社です。すぐの対応は要りません
情シスが今日やること
- 使っているモデルを洗い出します。 社内のシステムやスクリプトが、どのモデル名(claude-haiku-4-5など)を呼んでいるかを、開発担当に確認します。BedrockやGoogle Cloud、Foundry経由の利用も含めます
- 費用の試算をします。 直近1か月の入力・出力のトークン数を請求画面で確認し、上の単価を掛けて比べます。100,000トークンを超える依頼の割合も見ます
- 切り替えの試験を別の環境でします。 budget_tokensの指定がないか、返答の先頭に思考のブロックが付いても処理が壊れないかを確認します。品質は、自社の実際の問い合わせで確かめます
- 利用のルールを確認します。 入力するデータの種類、保存の扱い、契約先ごとの条件を、既存の生成AIの利用ルールと照らします。新しい小型モデルだからといって、扱ってよいデータが広がるわけではありません
- GitHub Copilotの設定を点検します。 Business・Enterpriseの管理者は、Copilotのモデルポリシーで、Haiku 5.5を有効にするか決めておきます
今日の情報で確かめきれないこと
発表に書かれていない点は、推測で補っていません。次のことは、利用前に自社の契約先で確認してください。
- 日本での提供条件、日本語での品質の比較
- 契約形態ごとの割引や、上限(レート制限)の具体的な値
- Haiku 4.5の提供終了の時期(この記事では確認していません)