Claude Haiku 5.5は入力0.10ドルからの最速モデル
Claude Haiku 5.5は、2026年10月7日に公開されたAnthropicの小型モデルです。APIではclaude-haiku-5-5を指定し、1Mトークンのコンテキストと最大128Kトークンの出力に対応します。
料金は入力100万トークンあたり0.10ドル、出力0.50ドルからです。Anthropicは標準速度で最も速いモデルと位置づけ、Haiku 4.5より平均で約75%安く動くと説明しています。個人開発では、要約や分類のような「数をこなす処理」を任せる先として最有力です。
※ 用語:コンテキスト=モデルが1回で参照できる入力や会話履歴の範囲。トークン=AIが文章を処理・課金するときの単位です。
Claude Haiku 5.5の料金は10万トークンで変わる
Haiku 5.5だけは、プロンプトの長さで単価が2段階に分かれます。10万トークンを超えるプロンプトは5倍の単価になるので、長い資料を丸ごと渡す使い方では割安感が薄れます。
| 100万トークンあたり | 10万以下 | 10万超 | Haiku 4.5 |
|---|---|---|---|
| 入力 | $0.10 | $0.50 | $1.00 |
| 出力 | $0.50 | $2.50 | $5.00 |
| キャッシュ読み出し | $0.01 | $0.05 | $0.10 |
| バッチ入力 / 出力 | $0.05 / $0.25 | $0.25 / $1.25 | $0.50 / $2.50 |
注意点は、トークナイザーが新しくなり、同じ文章がHaiku 4.5より約30%多いトークンに数えられることです。単価の差がそのまま請求額の差にはなりません。
※ 用語:トークナイザー=文章をトークンに分割する仕組み。バッチ=急がない依頼をまとめて送り、料金を半額にする方式です。
性能はHaiku 4.5から大きく伸びたがSonnet 5.5には届かない
公式発表の比較表(各モデルの最大設定での値)では、どの評価でもHaiku 4.5を大きく上回りました。一方、参考として並ぶSonnet 5.5にはすべての項目で届いていません。
| 評価 | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| OSWorld 2.1(offline subset) | 72.4% | 15.7% | 83.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 70.6% |
| Humanity's Last Exam(ツールなし) | 45.9% | 10.2% | 56.9% |
| Chartography(ツールなし) | 46.4% | 6.4% | 61.6% |
| GDPval-AA v2.1(Elo) | 1620 | 735 | 1840 |
Anthropic自身も、Terminal-Bench 4.0のような複雑なコーディングはSonnet 5.5やOpus 5.5が向くと書いています。Haiku 5.5は、範囲の狭いタスクを安く大量に回す用途のモデルです。
努力レベルでスコアと費用を選べる
Haiku 5.5は、Haiku系で初めて努力レベル(effort)を調整できます。APIの既定値はmediumです。公式ページのグラフでは、レベルごとのスコアと1回あたりの費用が公開されています。

OSWorld 2.1では、Lowが42.0%・0.07ドル、Maxが72.4%・0.61ドルでした。Sonnet 5.5のMaxは83.9%・5.73ドルなので、スコアは11.5ポイント低い代わりに費用は約9分の1です。公式のグラフは動的な表示のため、上の図は公表値から作り直しています。
※ 用語:ベンチマーク=決められた課題と採点方法でモデル性能を比べる試験。Elo=対戦結果から強さを数値化する指標。努力レベル=回答前の推論にかける量を調整する設定です。
個人開発での使いどころと移行の注意点
- ログやレビュー文の分類、要約、タグ付けなど、件数が多い処理
- 大きなモデルを主役にしたエージェントの、検索や下調べ担当(サブエージェント)
- 応答の速さが体験を左右するチャットやブラウザ操作の自動化
同日に、Sonnet 5.5のキャッシュ読み出しも0.20ドルから0.10ドルへ値下げされました。性能や移行の注意点はClaude Sonnet 5.5の解説記事にまとめています。
また、Maxプランの契約者にはAPIクレジットが毎月付きます。Max 5xは100ドル、Max 20xは200ドルで、発表のあった週から順次提供されます。
Haiku 4.5からの移行で壊れやすい点
移行ガイドでは、モデルIDの差し替え以外に次の変更が挙げられています。
thinkingのbudget_tokens指定は400エラー。{"type": "adaptive"}とoutput_config.effortに置き換えるtemperature・top_p・top_kは外す(既定値以外は400エラー)- アシスタントの書き出し指定(prefill)は400エラー
- 応答が
thinkingブロックで始まることがあり、先頭ブロックを答えとして読む実装は壊れる - 思考分も
max_tokensに含まれるため、小さい値だと本文の前で止まる stop_reason: "refusal"の処理を用意する
Claude Codeを使っているなら、/claude-api migrateで書き換えを自動化できます。
※ 用語:サブエージェント=主役のAIから一部の作業を任される補助役のAI。prefill=AIの返答の出だしをあらかじめ指定する手法。400エラー=リクエストの内容が不正なときに返るエラーです。
個人的な見解と利用時の注意点
個人向けの見解
これまで費用が気になって諦めていた「全件をAIに通す」処理が、個人の予算でも現実的になったと感じています。ただし賢さが要る実装はSonnet 5.5に任せ、Haiku 5.5は下請けに徹させる分担が堅実だと考えています。
個人開発での安全確認
- 秘密鍵、
.env、個人情報をプロンプトへ含めない - プロンプトが10万トークンを超えていないか、トークン数を実測する
- 大量処理は少数で試し、月額の上限を決めてから流す
- 移行後は
thinkingとレスポンスの読み取りを回帰テストする
※ 用語:回帰テスト=変更後も以前の機能が壊れていないか確かめる試験です。
まとめ
- Haiku 5.5は入力0.10ドル・出力0.50ドルからで、10万トークン超は5倍
- Haiku 4.5より大幅に高性能だが、複雑なコーディングはSonnet 5.5が上
- 努力レベルを下げれば、さらに安く速く使える
- 移行時は
thinking、サンプリング設定、prefillに注意
※ 用語:サンプリング設定=temperatureなど、出力のばらつきを調整するパラメータです。







