Journal約5分の、小さな発見。0%

Claude Haiku 5.5の料金と性能を個人開発向けに解説

投稿日
情報確認日
約5分で読めます#Claude#Claude Haiku 5.5#AI#個人開発
Claude公式マークと、白いフードの黒猫が砂時計を持ちながら机の上で紙飛行機を飛ばし、足元にコインの小瓶があるClaude Haiku 5.5のイラスト
カバー内の公式素材:

Claude Haiku 5.5は入力0.10ドルからの最速モデル

Claude Haiku 5.5は、2026年10月7日に公開されたAnthropicの小型モデルです。APIではclaude-haiku-5-5を指定し、1Mトークンのコンテキストと最大128Kトークンの出力に対応します。

料金は入力100万トークンあたり0.10ドル、出力0.50ドルからです。Anthropicは標準速度で最も速いモデルと位置づけ、Haiku 4.5より平均で約75%安く動くと説明しています。個人開発では、要約や分類のような「数をこなす処理」を任せる先として最有力です。

※ 用語:コンテキスト=モデルが1回で参照できる入力や会話履歴の範囲。トークン=AIが文章を処理・課金するときの単位です。

Claude Haiku 5.5の料金は10万トークンで変わる

Haiku 5.5だけは、プロンプトの長さで単価が2段階に分かれます。10万トークンを超えるプロンプトは5倍の単価になるので、長い資料を丸ごと渡す使い方では割安感が薄れます。

100万トークンあたり 10万以下 10万超 Haiku 4.5
入力 $0.10 $0.50 $1.00
出力 $0.50 $2.50 $5.00
キャッシュ読み出し $0.01 $0.05 $0.10
バッチ入力 / 出力 $0.05 / $0.25 $0.25 / $1.25 $0.50 / $2.50

注意点は、トークナイザーが新しくなり、同じ文章がHaiku 4.5より約30%多いトークンに数えられることです。単価の差がそのまま請求額の差にはなりません。

※ 用語:トークナイザー=文章をトークンに分割する仕組み。バッチ=急がない依頼をまとめて送り、料金を半額にする方式です。

性能はHaiku 4.5から大きく伸びたがSonnet 5.5には届かない

公式発表の比較表(各モデルの最大設定での値)では、どの評価でもHaiku 4.5を大きく上回りました。一方、参考として並ぶSonnet 5.5にはすべての項目で届いていません。

評価 Haiku 5.5 Haiku 4.5 Sonnet 5.5
OSWorld 2.1(offline subset) 72.4% 15.7% 83.9%
Terminal-Bench 4.0 39.2% 0.0% 70.6%
Humanity's Last Exam(ツールなし) 45.9% 10.2% 56.9%
Chartography(ツールなし) 46.4% 6.4% 61.6%
GDPval-AA v2.1(Elo) 1620 735 1840

Anthropic自身も、Terminal-Bench 4.0のような複雑なコーディングはSonnet 5.5やOpus 5.5が向くと書いています。Haiku 5.5は、範囲の狭いタスクを安く大量に回す用途のモデルです。

努力レベルでスコアと費用を選べる

Haiku 5.5は、Haiku系で初めて努力レベル(effort)を調整できます。APIの既定値はmediumです。公式ページのグラフでは、レベルごとのスコアと1回あたりの費用が公開されています。

Claude Haiku 5.5の努力レベル別スコアと費用をOSWorld、GDPval-AA、Humanity's Last Exam、Terminal-Bench 4.0の4評価で示した棒グラフ
出典: Anthropic公式発表 https://www.anthropic.com/claude-haiku-5-5 の掲載値を基に筆者作成 (2026年10月8日(木曜日)参照)

OSWorld 2.1では、Lowが42.0%・0.07ドル、Maxが72.4%・0.61ドルでした。Sonnet 5.5のMaxは83.9%・5.73ドルなので、スコアは11.5ポイント低い代わりに費用は約9分の1です。公式のグラフは動的な表示のため、上の図は公表値から作り直しています。

※ 用語:ベンチマーク=決められた課題と採点方法でモデル性能を比べる試験。Elo=対戦結果から強さを数値化する指標。努力レベル=回答前の推論にかける量を調整する設定です。

個人開発での使いどころと移行の注意点

  • ログやレビュー文の分類、要約、タグ付けなど、件数が多い処理
  • 大きなモデルを主役にしたエージェントの、検索や下調べ担当(サブエージェント)
  • 応答の速さが体験を左右するチャットやブラウザ操作の自動化

同日に、Sonnet 5.5のキャッシュ読み出しも0.20ドルから0.10ドルへ値下げされました。性能や移行の注意点はClaude Sonnet 5.5の解説記事にまとめています。

また、Maxプランの契約者にはAPIクレジットが毎月付きます。Max 5xは100ドル、Max 20xは200ドルで、発表のあった週から順次提供されます。

Haiku 4.5からの移行で壊れやすい点

移行ガイドでは、モデルIDの差し替え以外に次の変更が挙げられています。

  • thinkingのbudget_tokens指定は400エラー。{"type": "adaptive"}とoutput_config.effortに置き換える
  • temperature・top_p・top_kは外す(既定値以外は400エラー)
  • アシスタントの書き出し指定(prefill)は400エラー
  • 応答がthinkingブロックで始まることがあり、先頭ブロックを答えとして読む実装は壊れる
  • 思考分もmax_tokensに含まれるため、小さい値だと本文の前で止まる
  • stop_reason: "refusal"の処理を用意する

Claude Codeを使っているなら、/claude-api migrateで書き換えを自動化できます。

※ 用語:サブエージェント=主役のAIから一部の作業を任される補助役のAI。prefill=AIの返答の出だしをあらかじめ指定する手法。400エラー=リクエストの内容が不正なときに返るエラーです。

個人的な見解と利用時の注意点

個人向けの見解

これまで費用が気になって諦めていた「全件をAIに通す」処理が、個人の予算でも現実的になったと感じています。ただし賢さが要る実装はSonnet 5.5に任せ、Haiku 5.5は下請けに徹させる分担が堅実だと考えています。

個人開発での安全確認

  • 秘密鍵、.env、個人情報をプロンプトへ含めない
  • プロンプトが10万トークンを超えていないか、トークン数を実測する
  • 大量処理は少数で試し、月額の上限を決めてから流す
  • 移行後はthinkingとレスポンスの読み取りを回帰テストする

※ 用語:回帰テスト=変更後も以前の機能が壊れていないか確かめる試験です。

まとめ

  • Haiku 5.5は入力0.10ドル・出力0.50ドルからで、10万トークン超は5倍
  • Haiku 4.5より大幅に高性能だが、複雑なコーディングはSonnet 5.5が上
  • 努力レベルを下げれば、さらに安く速く使える
  • 移行時はthinking、サンプリング設定、prefillに注意

※ 用語:サンプリング設定=temperatureなど、出力のばらつきを調整するパラメータです。

SOURCES / 出典

本記事は以下の一次情報(公式サイト・公式ドキュメント)を確認して執筆しています。

  1. [1]
    Introducing Claude Haiku 5.5— Anthropichttps://www.anthropic.com/claude-haiku-5-5最終参照日: 2026年10月8日(木曜日)
  2. [2]
  3. [3]
    Pricing - Claude Platform Docs— Anthropichttps://platform.claude.com/docs/en/about-claude/pricing最終参照日: 2026年10月8日(木曜日)
  4. [4]