Claude Haiku 5.5とは?料金$0.10/$0.50(10万トークン以下)・Haiku 4.5との違い・effort設定・使い方【2026年10月】

この記事のポイント
Claude Haiku 5.5は、Anthropicが2026年10月7日に公開したClaude 5.5世代の最小・最速モデル。10万トークン以下のプロンプトなら入力$0.10・出力$0.50(100万トークンあたり)とHaiku 4.5の10分の1。Haiku 4.5との違い、effortの選び方、API・Claude Codeでの使い方、移行時の注意点を解説します。
Claude Haiku 5.5は、Anthropicが2026年10月7日(米国時間)に公開した、Claude 5.5世代で最も小さく、最も速いモデルです。API料金は10万トークン以下のプロンプトなら入力$0.10・出力$0.50(100万トークンあたり)で、Haiku 4.5の10分の1です。Haikuとして初めて100万トークンのコンテキストとeffort設定に対応しました。
公式が想定する用途は、分類・要約・ルーティング・サブエージェントのように件数が多く、速さが求められる仕事です。一方、複雑なエージェント型コーディングについては「Sonnet 5.5やOpus 5.5の方が引き続き良い選択」と公式自身が書いています。
この記事でわかること
- Claude Haiku 5.5の基本仕様と、Claude 5.5世代の中での位置づけ
- Haiku 4.5との違い(性能・料金・仕様・破壊的変更)
- 「10万トークン以下/超」で単価が変わる料金体系と、具体的な試算
- effort 5段階(low〜max)の選び方と、思考をオフにできる条件
- claude.ai・API・Claude Codeでの使い方
- Sonnet 5.5・Opus 5.5との使い分け、こんな人におすすめ/おすすめしない人
こんな方に向けた記事です
- Haiku 4.5をAPIで使っていて、乗り換えるか判断したい開発者
- 問い合わせ分類や要約などの大量処理のコストを下げたい担当者
- Claude Codeのサブエージェントや軽い作業を安く速く回したい人
Claude Haiku 5.5の要点
- 料金:10万トークン以下のプロンプトなら入力$0.10/出力$0.50(Haiku 4.5比90%安)。10万トークンを超えると入力$0.50/出力$2.50に上がる
- 性能:公式ベンチではHaiku 4.5を全項目で大きく上回る。ただしSonnet 5.5には全項目で届かない
- 向いている仕事:分類・抽出・要約・チャット・サブエージェント・ブラウザ操作の自動化。難しいコーディングや長文を安く読ませる用途には向かない
Claude全体の概要から知りたい方は「Claudeとは」を先に読むと理解が早いです。
Claude Haiku 5.5とは|Claude 5.5世代の「最小・最速」モデル

Claude Haiku 5.5は、Anthropicが「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけるモデルです。公式のモデル一覧では「分類・抽出・ルーティングのような、大量・低レイテンシが求められるタスク向け」と説明されています。
9月22日のOpus 5.5、9月28日のSonnet 5.5に続いてHaiku 5.5が出たことで、5.5世代の3モデルがそろいました。
基本仕様
項目 | 内容 |
|---|---|
開発元 | Anthropic |
公開日 | 2026年10月7日(米国時間。日本時間10月8日未明) |
APIモデルID |
|
Amazon Bedrock のID |
|
Google Cloud / Microsoft Foundry / Claude Platform on AWS のID |
|
入力 / 出力 | テキスト・画像を入力 → テキストを出力 |
コンテキストウィンドウ | 100万(1M)トークン(ベータヘッダ不要) |
最大出力 | 128Kトークン(Message Batches APIではベータヘッダ |
思考(Thinking) | Adaptive thinking(既定でオン) |
effort | low / medium / high / xhigh / max の5段階。既定は medium |
知識カットオフ | 2026年6月 |
速度 | 現行ラインナップで最速(Fast mode時のOpusを除く) |
廃止時期の目安 | 2027年10月7日より前には廃止しないと公式が明記 |
出典:Anthropic 公式モデルページ、Models overview
2026年10月時点のClaude現行モデル
項目 | Claude Fable 5.1 | Claude Opus 5.5 | Claude Sonnet 5.5 | Claude Haiku 5.5 |
|---|---|---|---|---|
公式の説明 | 高度な推論と長時間のエージェント作業 | 長時間のエージェント型コーディングとナレッジワーク | 速度と知能のバランス | 大量・低レイテンシ(分類・抽出・ルーティング) |
API料金(入力/出力、$/100万トークン) | $10 / $50 | $4 / $20 | $2 / $10 | $0.10 / $0.50(10万トークン超は$0.50 / $2.50) |
既定effort | high | medium | high | medium |
コンテキスト / 最大出力 | 1M / 128K | 1M / 128K | 1M / 128K | 1M / 128K |
相対速度 | 遅め | 中程度 | 速い | 最速 |
APIモデルID |
|
|
|
|
Haiku 4.5はHaiku 5.5の公開と同時に「レガシー」区分に移りました。現時点でも利用はできます。なお公式のおすすめは「迷ったらOpus 5.5から」で、Haiku 5.5は既定ではなく、用途を選んで使うモデルという扱いです。
Haiku 4.5との違い|料金は10分の1、性能は大幅に向上
Haiku 4.5と比べると、料金が下がったうえに、性能もまったく別のモデルと言えるほど上がっています。ただし、トークンの数え方とAPIの仕様が変わっているため、モデルIDを差し替えるだけでは動かない場合があります。
仕様・料金の比較
項目 | Claude Haiku 5.5 | Claude Haiku 4.5 |
|---|---|---|
入力料金($/100万トークン) | $0.10(10万トークン以下)/$0.50(10万トークン超) | $1.00 |
出力料金($/100万トークン) | $0.50(10万トークン以下)/$2.50(10万トークン超) | $5.00 |
コンテキストウィンドウ | 1Mトークン | 200Kトークン |
最大出力 | 128Kトークン | 64Kトークン |
思考 | Adaptive thinking(既定オン) | 手動のextended thinking( |
effort設定 | 対応(5段階) | 非対応 |
Browser use tool | 対応(Claude APIとGoogle Cloud) | 非対応 |
トークナイザー | 新方式(同じ文章で約30%多く数える) | 旧方式 |
| 既定値以外はエラー | 指定可 |
assistant prefill | エラー | 利用可 |
現在の区分 | 現行モデル | レガシー(利用は可能) |
公式ベンチマークの比較
公式発表に掲載された数値です。いずれもAnthropicの自己申告で、どのeffortで測ったかは発表ページに記載がありません。
ベンチマーク | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
GDPval-AA v2.1(Elo) | 1620 | 735 | 1840 |
OSWorld 2.1(offline subset) | 72.4% | 15.7% | 83.9% |
Humanity's Last Exam(ツールなし) | 45.9% | 10.2% | 56.9% |
Humanity's Last Exam(ツールあり) | 57.4% | 18.7% | 64.5% |
Terminal-Bench 4.0 | 39.2% | 0.0% | 70.6% |
Chartography(ツールなし) | 46.4% | 6.4% | 61.6% |
PC操作の自動化を測るOSWorldが15.7%→72.4%、実務タスクを測るGDPval-AAも2倍以上と、伸び幅は大きいです。一方、エージェント型コーディングのTerminal-Benchは39.2%で、Sonnet 5.5(70.6%)とはまだ差があります。発表前には「HaikuがOpusを超える」といった噂も出回りましたが、公式ベンチではSonnet 5.5にも全項目で届いていません。
公式発表には、各社の評価結果も載っています(いずれも各社提供の数値)。
- Asana:タスク完了までのレイテンシが30%以上短縮
- Box:Haiku 4.5比で11ポイント向上、レイテンシは約半分
- AlphaSense:400クエリの評価で0.84(Haiku 4.5は0.76)
Claude Haiku 5.5でできること
Haiku 5.5が得意なのは、ひとつひとつは単純でも件数が多い仕事と、応答の速さが体験を左右する仕事です。公式が挙げる用途を、実務の場面に置き換えると次のようになります。
用途 | 具体的な業務例 | 向いている理由 |
|---|---|---|
大量テキストの処理 | 問い合わせの振り分け、レビューの感情分類、議事録の要約、商品説明文の生成 | 単価が安く、件数が多くても費用が膨らみにくい |
リアルタイム応答 | Webチャット、音声エージェント、ライブサポート、アプリ内アシスタント | 現行ラインナップで最速 |
サブエージェント | Opus 5.5/Sonnet 5.5が立てた計画のうち、調査・要約・ファイル検索などの切り出した作業を担当 | 親モデルより安く、並列に回しやすい |
ブラウザ・デスクトップ操作 | フォーム入力、データ入力、アプリ間の転記 | OSWorldで72.4%。Browser use toolにも対応 |
範囲の狭いコーディング | 決まった修正、多数ファイルへの小さな一括変更 | 修正内容がはっきりしていれば十分こなせる |
エージェント基盤の部品 | ルーティング、会話の要約、コンテキスト圧縮(compaction) | 処理回数が多い裏方の仕事を安く回せる |
サブエージェントの構成は「Claude Code サブエージェントの使い方」、PC操作の自動化は「Claude Computer Useとは」で詳しく解説しています。
Claude Haiku 5.5の強み
Haiku 5.5の強みは、価格・速度・性能の3つが同時に上がった点です。
- 短いプロンプトなら圧倒的に安い:10万トークン以下なら入力$0.10。公式発表は、Haiku 4.5で処理していたリクエストの90%が10万トークン以下だったことと、新トークナイザーでトークン数が増える分を含めても、平均で約75%安く動かせるとしています(算出方法の詳細は非公開)
- 小型モデルなのに1Mコンテキスト:長い資料や長い会話をそのまま渡せる(ただし10万トークンを超えると単価が5倍になる)
- effortで品質とコストを調整できる:Haikuでeffortを選べるのは今回が初めて。簡単な仕事はlow、指示を厳密に守らせたい仕事はhighと使い分けられる
- 最速:現行ラインナップで最も速く、チャットや音声のように待ち時間が体験を左右する用途に向く
- キャッシュ読み取りが$0.01:同じシステムプロンプトを使い回す大量処理では、キャッシュの効果が大きい
- アライメントの改善:公式によると、Haiku 4.5より不整合な振る舞いが少なく、悪用への協力意欲も低い
Claude Haiku 5.5の弱み・制約
Haiku 5.5は万能ではありません。導入前に知っておきたい制約は次のとおりです。
- 複雑なエージェント型コーディングは苦手:Terminal-Bench 4.0はSonnet 5.5の70.6%に対し39.2%。公式も、複雑なコーディングとナレッジワークはOpus 5.5、範囲の決まったタスクはSonnet 5.5を勧めている
- 長文を安く処理する用途には向かない:10万トークンを超えるプロンプトは単価が5倍。1Mコンテキストは「使える」が「安い」わけではない
- 同じ文章でもトークン数が約30%増える:単価だけを比べても実際の費用は比べられない
- モデルIDの差し替えだけでは動かないことがある:
temperatureの指定、prefill、budget_tokensがエラーになる - 使えない機能がある:Priority Tier、Fast mode、拒否時に別モデルへ回すサーバー側フォールバックは非対応。Amazon Bedrockでは構造化出力が使えない
- 低effortでは作業を省くことがある:長いエージェント用プロンプトとlowを組み合わせると、検索の省略や早めの打ち切り、未検証のままの完了報告が起きやすいと公式が注意している
Claude Haiku 5.5の料金|10万トークンを境に単価が変わる

API料金は、プロンプトが10万トークン以下なら入力$0.10・出力$0.50、10万トークンを超えると入力$0.50・出力$2.50です(いずれも100万トークンあたり)。プロンプトの長さで単価が変わるのは、現行モデルではHaiku 5.5だけです。
API料金表($/100万トークン)
項目 | Haiku 5.5(10万トークン以下) | Haiku 5.5(10万トークン超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
入力 | $0.10 | $0.50 | $1.00 | $2.00 |
出力 | $0.50 | $2.50 | $5.00 | $10.00 |
5分キャッシュ書き込み | $0.125 | $0.625 | $1.25 | $2.50 |
1時間キャッシュ書き込み | $0.20 | $1.00 | $2.00 | $4.00 |
キャッシュ読み取り | $0.01 | $0.05 | $0.10 | $0.10 |
Batch 入力 / 出力(50%引き) | $0.05 / $0.25 | $0.25 / $1.25 | $0.50 / $2.50 | $1.00 / $5.00 |
出典:Anthropic 公式 Pricing(2026年10月8日確認)
料金表の補足は次のとおりです。
- 米国内での推論を指定する場合(
inference_geo: "us")は、全項目が1.1倍になります - キャッシュ読み取りは基本入力の10%です。Opus 5.5/Sonnet 5.5(5%)とは倍率が違います
- 同日発表で、Sonnet 5.5のキャッシュ読み取りは$0.20→$0.10に値下げされました
「10万トークン以下」と「10万トークン超」の境界
ネットでは「10万トークン未満」という表記も見かけますが、公式の表記は「up to 100,000 tokens(10万トークン以下)」と「over 100,000 tokens(10万トークン超)」です。ちょうど10万トークンは安い側に入ります。
ただし、境界の細かな扱いには、公式で明記されていない点も残っています。
論点 | 現時点でわかっていること |
|---|---|
境界の向き | 10万トークン以下は安い単価、10万トークン超は高い単価(公式で確認) |
超えたら全体が高くなるのか | 公式の料金表は「10万トークン超のプロンプト」で単価表を切り替える書き方。超過分だけ高くなるという記述はなく、そのリクエスト全体に高い単価がかかると読める。ただし明文の説明はない |
キャッシュの読み書き分を長さに含むか | 公式に定義がなく未確認 |
出力トークンを含むか | 「プロンプト」の長さで判定するため含まない可能性が高いが、公式の明記はない |
もうひとつ気をつけたいのがトークナイザーです。Haiku 5.5は同じ文章を約30%多く数えるため、Haiku 4.5で8万トークンだった入力が、Haiku 5.5では約10.4万トークンになり、高い単価に入ることがあります。長めのプロンプトを流しているなら、移行前に count_tokens などで実際のトークン数を測り直しておくと安心です。
費用の試算例
前提を置いて、実際にいくらになるかを計算しました。effortに応じた思考トークンは出力に加算されるため、実際の費用はこれより増えます。
ケース | Haiku 5.5 | Haiku 4.5 |
|---|---|---|
問い合わせ1万件の分類(1件あたり入力2,000・出力200トークン。Haiku 4.5側は同じ文章を約1/1.3のトークン数で計算) | 入力$2.00+出力$1.00=約$3.00 | 入力約$15.38+出力約$7.69=約$23 |
同じ1万件をBatch APIで処理 | 約$1.50 | 約$11.5 |
12万トークンの長い資料を1回読ませる(入力のみ) | $0.06(10万トークン超の単価) | 約$0.092(約9.2万トークンとして) |
短いプロンプトの大量処理なら、Haiku 4.5から9割近く下がります。一方、12万トークンの資料1回では、Haiku 4.5よりは安いものの、10万トークン以下の単価だった場合($0.012)の5倍です。長い資料は、必要な部分だけを切り出して10万トークン以下に収めると費用を抑えられます。
claude.ai・Claude Codeでの扱い
Haiku 5.5はAPIだけでなく、サブスクリプションでも使えます。
利用先 | 内容 |
|---|---|
claude.ai(Web / iOS / Android) | Free・Pro・Max・Team・Enterpriseの全プランでHaiku 5.5を選べる |
Claude Code | v2.1.293以降で利用可能。Anthropic APIでは既定のHaikuモデルがHaiku 5.5になった |
Max / Team の月次APIクレジット(同日発表) | Max 5xは月$100、Max 20xは月$200、Teamは最大$500(メンバーで共有)。発表週から順次付与され、どのモデルにも使える |
claude.aiで既定のモデルが変わったか、Haiku 5.5を使ったときの利用上限の消費量については、現時点で公式の説明を確認できていません。プラン全体の料金は「Claudeの料金」、Maxプランの詳細は「Claude Maxプラン解説」にまとめています。
effort設定の選び方|既定はmedium、迷ったらmediumから
effortは、Haiku 5.5がどれだけ考えてから答えるかを決める設定です。上げるほど品質は上がりやすくなる一方、思考トークンが増えるため遅く、高くなります。Haiku 5.5の既定はmediumで、公式は「エージェント型コーディングを含むほとんどの作業はmediumから始める」よう勧めています。
effort | 公式が勧める使い方(Haiku 5.5) | 実務での例 |
|---|---|---|
| 最安・最速。チャット、短いツール作業、単純な大量リクエスト | 問い合わせ分類、タグ付け、定型の要約 |
| ほとんどの作業の出発点。エージェント型コーディングもここから | サブエージェント、小さなコード修正、RAGの回答生成 |
| ナレッジワーク、長めのエージェント作業、厳密な指示順守 | ルールの多いチャットボット、手順を守らせたい業務自動化 |
| 自社の評価で品質向上を確認できた場合だけ使う。思考と応答が大幅に長くなる | 使う前にSonnet 5.5と性能・費用・速度を比べる |
出典:Effort(Anthropic 公式ドキュメント)、Prompting Claude Haiku 5.5
xhigh/maxにするなら、Sonnet 5.5をmediumやhighで使ったほうが安く速く済むケースもあります。Haiku 5.5を高いeffortで粘らせるより、モデルを上げるという選択肢を常に比べてください。
思考をオフにできる条件(APIとClaude Codeで違う)
Haiku 5.5の思考は既定でオンです。オフにできるかどうかは、使う場所によって違います。
利用先 | 思考をオフにできるか |
|---|---|
Claude API | effortが |
Claude Code | オフにできない( |
Anthropicのテストでは、プロンプトで「考えずに直接答えて」と書いても思考は止まりませんでした。思考を減らしたいときは、プロンプトではなくeffortを下げるのが確実です。
ほかにも、effortまわりで公式が挙げている注意点があります。
- xhighのマルチターンチャットでは、答えをすべて思考の中に書いてしまい、表示されるテキストが空になることがある
- 会話の途中でトップレベルのeffortを変えると、プロンプトキャッシュが無効になる。メッセージ単位でeffortを変えるベータ機能(ヘッダ
mid-conversation-output-config-2026-07-01)を使えばキャッシュは保たれる(Claude APIとGoogle Cloudで対応。思考オフ時は不可) - 思考オフとJSONの構造化出力を組み合わせると、必要なツール呼び出しを飛ばすことがある
Claude Haiku 5.5の使い方

出典:GitHub「anthropics/anthropic-sdk-python」
Haiku 5.5は、claude.ai・API・Claude Codeの3つの経路で使えます。
claude.aiで使う
- claude.ai(Web、またはiOS/Androidアプリ)にログインする
- 入力欄のモデル選択メニューを開く
- 「Claude Haiku 5.5」を選んでチャットする
Freeプランでも選べるので、まずは手元の文章の要約や分類で速さと品質を確かめるのが手軽です。
APIで使う
モデルIDは claude-haiku-5-5 です。分類のような単純な大量処理なら、effortをlowにすると速く安く回せます。
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
output_config={"effort": "low"},
messages=[
{
"role": "user",
"content": "次の問い合わせを「請求」「不具合」「その他」のいずれかに分類してください: ...",
}
],
)
for block in response.content:
if block.type == "text":
print(block.text)Haiku 4.5と同じ感覚で書くとエラーになる点があるため、次の点に注意してください。
temperature・top_p・top_kは指定しない(既定値以外はエラー)messagesの最後はuserのメッセージにする(assistantのprefillはエラー)- 応答が思考ブロックから始まることがあるため、
content[0]のように位置で取らず、typeで本文を選ぶ
max_tokens には思考トークンも含まれるので、Haiku 4.5のときより余裕を持たせておくと、途中で出力が切れるのを防げます。Amazon Bedrock・Google Cloud・Microsoft Foundry・Claude Platform on AWSでも提供されています(AWS経由の利用は「Claude Platform on AWSとは」を参照)。
Claude Codeで使う
Claude Codeでは、v2.1.293以降でHaiku 5.5を使えます。古い場合は claude update で更新してください。
# 起動時にHaiku 5.5を指定
claude --model claude-haiku-5-5
# セッション中に切り替え
/model claude-haiku-5-5haikuエイリアスの中身はプロバイダで違う:Anthropic APIではHaiku 5.5を指しますが、Claude Platform on AWS・Bedrock・Google Cloud・Microsoft FoundryではHaiku 4.5のままです。これらでHaiku 5.5に固定したい場合は、環境変数ANTHROPIC_DEFAULT_HAIKU_MODEL="claude-haiku-5-5"を設定します- 既定モデルはHaiku 5.5ではない:Pro・Max・Team・Enterprise・APIの既定(
default)はOpus 5.5です - 1Mコンテキストは全プランで有効:既定では約967Kトークンで自動圧縮が始まります
- 利用条件:Claude Code自体は、一般的にはPro以上のプランかAPIキーが必要とされています。最新の条件は公式のプランページで確認してください
Claude Codeの全体像は「Claude Codeとは」、費用を抑える設定は「Claude Codeコスト最適化ガイド」と「Claude Codeの料金」で解説しています。
Haiku 4.5から移行するときのチェックポイント
Haiku 4.5からHaiku 5.5への移行は、モデルIDを変えるだけでは済まないことがあります。公式の移行ガイドで「破壊的変更」とされているのは5点です。
変更点 | Haiku 4.5での書き方 | Haiku 5.5での対応 |
|---|---|---|
手動のextended thinking |
| エラーになる。adaptive thinking+effortに置き換える |
サンプリングパラメータ |
| 既定値以外はエラー。指定を削除する |
assistant prefill | 最後にassistantの書き出しを置く | エラーになる。userで終え、構造化出力などで代替する |
Computer use |
| API/Google Cloudでは |
過去ターンの書き換え | 会話履歴を編集して再送 | 思考ブロックが無効になる。会話は追記のみにする |
あわせて、次の変更にも対応が必要です。
- 同じ文章で約30%多くトークンを数えるため、
max_tokens・費用見積もり・10万トークン境界を計算し直す - 思考の本文は既定で省略される。要約を表示したい場合は
thinking.display: "summarized"を指定する - 思考ブロックは、生成したアカウント(または連携アカウント)でしか有効にならない。別アカウントを経由して会話を再生しない
- 安全分類器による拒否(
stop_reason: "refusal")が返る場合があるため、その処理を追加する - Priority Tierを契約している組織は、Haiku 5.5が非対応のため容量計画を見直す
移行前後のコード例
# Haiku 4.5(そのままHaiku 5.5に向けるとエラーになる書き方)
client.messages.create(
model="claude-haiku-4-5",
max_tokens=2048,
temperature=0.2,
thinking={"type": "enabled", "budget_tokens": 1024},
messages=[
{"role": "user", "content": "次の文章をJSONで要約して: ..."},
{"role": "assistant", "content": "{"}, # prefill
],
)
# Haiku 5.5
client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
output_config={"effort": "medium"},
messages=[
{"role": "user", "content": "次の文章をJSONで要約して: ..."},
],
)Claude Codeを使っているなら、/claude-api migrate this project to claude-haiku-5-5 で移行作業を自動化できると公式が案内しています。Managed Agentsの利用者は、モデル名を変えるだけで済みます。
Haiku 4.5はいつまで使えるのか
Haiku 4.5は現在もActive(利用可能)です。ただし、公式の廃止スケジュールでは「2026年10月15日より前には廃止しない」とされており、10月15日以降はいつ廃止予告が出てもおかしくありません。公式は廃止の60日以上前に通知するとしているため、すぐに止まるわけではありませんが、移行の検証は早めに始めておくのが無難です。
出典:Model deprecations(Anthropic 公式)、Haiku 5.5 移行ガイド
セキュリティと安全面の注意点
Haiku 5.5では、安全分類器による拒否が新たに導入されました。正当な業務でも誤って拒否されることがあるため、業務システムに組み込む場合は拒否時の処理を設計しておく必要があります。
拒否されやすい4つのカテゴリ
拒否時は stop_reason: "refusal" が返り、stop_details.category で理由のカテゴリがわかります。
カテゴリ | 対象 | 補足 |
|---|---|---|
| マルウェアやエクスプロイトの開発など | ソースコードの脆弱性発見は可。Haiku 4.5より厳しく、Sonnet 5.5よりはやや緩い |
| 危険な実験手法など | 日常的な健康・教育の質問は影響なし。Sonnet 5.5/Opus 5と同水準 |
| 競合するAIモデル開発の支援 | ― |
| その他の有害な依頼 | ― |
同じリクエストを再送しても、たいていは再び拒否されます。拒否された場合に別モデルへ自動で回すサーバー側の仕組みはないため、必要ならアプリ側でフォールバックを組みます。ペネトレーションテストなど正当なセキュリティ業務で使う場合は「Cyber Verification Program」、生命科学の研究ではLife Sciences Verification Programへの申請が案内されています。
運用で気をつけたい点
- プロンプトインジェクション対策の副作用:Haiku 5.5は、ツールの結果(
tool_result)に含まれる指示を信用しないよう訓練されています。そのため、ユーザーの途中入力をtool_resultに入れて渡すと無視されることがあります。ユーザーの発言はuserターンとして渡してください - チャットボットの逸脱:ユーザーが食い下がると、システムプロンプトの方針から外れることがあります。公式の推奨文をシステムプロンプトに加え、指示順守が重要ならeffortをhighにします
- 会話データの共有:思考ブロックはアカウントに紐づくため、マルチテナントで会話ストアを共有するサービスは設計に注意が必要です
- データの処理場所:APIでは
inference_geo: "us"で米国内推論を指定できます(料金1.1倍)。Bedrock・Google Cloudはリージョナルエンドポイントで+10%です
Sonnet 5.5・Opus 5.5との使い分け

出典:Claude Platform Docs「Models overview」
Claude 5.5世代の3モデルは、「Haikuで数をこなし、Sonnetで普段の仕事、Opusで難しい仕事」と分けるのが基本です。
用途別のおすすめモデル
やりたいこと | 最初に試すモデル | effortの目安 | 判断ポイント |
|---|---|---|---|
問い合わせ・レビューの分類 | Haiku 5.5 | low | 精度が足りなければmedium |
議事録・記事の要約 | Haiku 5.5 | low〜medium | 10万トークン以下に収まるか |
Webチャット・音声エージェント | Haiku 5.5 | low〜high | ルールを厳密に守らせたいならhigh |
サブエージェント(調査・検索・要約) | Haiku 5.5 | medium | 親エージェントはSonnet 5.5/Opus 5.5 |
フォーム入力などのブラウザ操作 | Haiku 5.5 | medium | 失敗時の再実行コストも含めて比べる |
決まった範囲のコード修正 | Haiku 5.5またはSonnet 5.5 | medium | 修正範囲がはっきりしているか |
複数ファイルにまたがる設計・実装 | Sonnet 5.5/Opus 5.5 | ― | Haiku 5.5は向かない |
長い資料の精読・分析 | Sonnet 5.5/Opus 5.5 | ― | Haiku 5.5は10万トークン超で単価5倍 |
Sonnet 5.5は「Claude Sonnet 5.5とは」、Opus 5.5は「Claude Opus 5.5とは」で詳しく解説しています。
他社の小型モデルとの比較
VentureBeatの報道によると、Haiku 5.5の基本料金($0.10/$0.50)はOpenAIのGPT-6 Lunaと同額です。ただし、高い単価に切り替わる境界は、Haiku 5.5が10万トークン超、GPT-6 Lunaは27.2万入力トークン超と報じられており、長いプロンプトではGPT-6 Lunaのほうが有利になる可能性があります。Anthropicの公式ベンチでは、OSWorld(Haiku 5.5:72.4%、GPT-6 Luna:48.9%)やTerminal-Bench 4.0(39.2%、16.4%)でHaiku 5.5が上回っています。
他社の料金は報道ベースの数値です。採用を決める前に、各社の公式料金ページで確認してください。ChatGPTとの違いは「Claude vs ChatGPT 比較」で整理しています。
Claude Haiku 5.5がおすすめな人・おすすめしない人
Haiku 5.5が合うかどうかは、「扱う仕事の数と長さ」で決まります。
こんな人におすすめ
- Haiku 4.5で分類・要約・抽出などの大量処理をしていて、費用を大きく下げたい人
- 1回あたりのプロンプトが10万トークン以下に収まる業務が中心の人
- チャットボットや音声エージェントで、応答の速さを優先したい人
- Opus 5.5/Sonnet 5.5を親にしたマルチエージェント構成で、サブエージェントを安く回したい人
- フォーム入力やアプリ間の転記など、定型のPC操作を自動化したい人
- claude.aiで、短い質問を手早く処理したい人
おすすめしない人
- 複数ファイルにまたがる設計・実装など、難しいエージェント型コーディングを任せたい人(Sonnet 5.5/Opus 5.5向き)
- 10万トークンを超える長文を、毎回まるごと安く読ませたい人
- Haiku 4.5のコードを修正する余裕がなく、モデルIDの差し替えだけで済ませたい人
- Priority TierやFast modeが前提の運用をしている人
- ペネトレーションテストなど、攻撃側に寄ったセキュリティ業務が中心の人(拒否されやすい)
よくある質問
Q. Claude Haiku 5.5は無料で使えますか?
claude.aiのFreeプランでもHaiku 5.5を選べます。ただしFreeプランには利用回数の上限があり、Haiku 5.5を使ったときの消費量は公式で明示されていません。APIは従量課金のため、無料枠を前提にした利用はできません。
Q. 10万トークンちょうどのプロンプトはどちらの単価ですか?
安い側(入力$0.10・出力$0.50)です。公式の表記は「10万トークン以下」と「10万トークン超」なので、10万トークンを1でも超えると高い単価になります。
Q. Haiku 4.5で動いているシステムは、いつまでに移行すればいいですか?
現時点で廃止日は決まっていません。公式は「2026年10月15日より前には廃止しない」とし、廃止の60日以上前に通知するとしています。破壊的変更への対応やトークン数の再見積もりに時間がかかるため、検証環境での試験は早めに始めるのが安全です。
Q. effortは毎回指定する必要がありますか?
指定しなければmediumで動きます。mediumを明示した場合も省略した場合と同じ動作です。大量の分類などで速度と費用を優先したいときだけ、output_config={"effort": "low"} を指定すれば十分です。
Q. 日本語の処理に使えますか?
使えます。ただし、新しいトークナイザーでは同じ文章のトークン数がHaiku 4.5より約30%増えるとされています。日本語の長文を扱う場合は、実際のデータでトークン数を測ってから費用を見積もってください。
Q. Claude CodeでHaiku 5.5に切り替えたのに、Haiku 4.5で動いているようです。
Bedrock・Google Cloud・Microsoft Foundry・Claude Platform on AWS経由で使っている場合、haiku エイリアスはHaiku 4.5を指します。/model claude-haiku-5-5 のようにモデルIDで指定するか、ANTHROPIC_DEFAULT_HAIKU_MODEL を設定してください。Claude Code本体がv2.1.293より古い場合は、claude update での更新も必要です。
まとめ
Claude Haiku 5.5は、10万トークン以下のプロンプトなら入力$0.10・出力$0.50と、Haiku 4.5の10分の1の料金で使えるClaude 5.5世代の最小・最速モデルです。1Mコンテキストとeffort設定に対応し、公式ベンチではHaiku 4.5から大きく性能を伸ばしています。
導入の際は、次の点を押さえておくと失敗を防げます。
- 料金は10万トークンを超えると5倍になる。トークナイザーの変更で、同じ文章が約30%多く数えられる
- effortはmediumから始め、大量処理はlow、指示順守が重要ならhighにする。xhigh/maxを使う前にSonnet 5.5と比べる
- Haiku 4.5からの移行では、
temperature・prefill・budget_tokensがエラーになる - 難しいコーディングや長文の精読はSonnet 5.5/Opus 5.5に任せ、Haiku 5.5は数の多い仕事に回す
まずはclaude.aiやAPIのlow effortで、自社の分類・要約タスクを小さく試してみるのがおすすめです。Claudeの他モデルやプランとあわせて検討するなら、「Claudeとは」と「Claudeの料金」もあわせて参考にしてください。
このツールを自社の毎月の業務に組み込むと何が変わるか、ご提案します
業務を1つ送るこの記事の著者

AI革命
編集部
AI革命株式会社の編集部です。最新のAI技術動向から実践的な導入事例まで、企業のデジタル変革に役立つ情報をお届けしています。豊富な経験と専門知識を活かし、読者の皆様にとって価値のあるコンテンツを制作しています。
最新記事

AI導入の相談タイミングはいつ?|要件が固まる前に相談する利点と段階別の費用【2026年10月最新】
2026/09/21

システム引き継ぎで開発会社を変更するには|ソースと資料から頼める調査を決める
2026/10/08

Claude Max・TeamのAPIクレジットとは|毎月$100/$200(Teamは最大$500)・対象・受け取り方・Agent SDKクレジットはどうなった?【2026年10月】
2026/10/08

システムの改修とリプレイスを比較|どちらが安いか、5年総額と現状調査・切戻し条件で判断する
2026/09/20

Claude Securityとは?Mythos 5.1で動く脆弱性スキャンの機能・料金・制約とCrowdStrike/Palo Alto連携【2026年10月】
2026/05/01

SaaSかカスタム開発かの判断フロー|既製品で足りる条件と一部だけ作る範囲、AI自作の比べ方
2026/09/16


