最大90%値下げのClaude Haiku 5.5、トークン消費増で実際のお得度に差
「Haiku 5.5 is a good Haiku(Haiku 5.5はちゃんとしたHaikuだ)」。
Anthropicの開発者Boris Chernyさんが10月7日、新しい小型AIモデルについてこう投稿しました。
価格を見れば確かに「良い」と言いたくなる数字が並んでいます。
ただ、調べていくと「安い」という言葉だけでは説明が終わらない事情も見えてきました。
ChatGPTやClaudeを業務で使い分けている人にとって、この値下げの中身は意外と知っておく価値があります。
先に結論をまとめると:
– Claude Haiku 5.5は入力トークン最大90%・出力含め平均75%のコストダウンで登場しました
– OSWorld(パソコン操作の正答率)は15.7%から72.4%へ跳ね上がりました
– ただし新しいトークナイザーの影響で、同じ作業でも消費トークンがおよそ30%増えるとAnthropic公式が説明しており、価格の下がり方がそのまま請求額の下がり方にはならないケースがあります
何が起きたのか
Anthropicは現地時間10月7日、Claude 5.5ファミリーの3つ目となる小型モデル「Claude Haiku 5.5」を公開しました。
公式の発表はこうです。
英訳: 「Claude Haiku 5.5を発表します。
これまでにリリースした中で最も安く、速く、高性能な小型モデルです。
平均して、Claude Haiku 4.5より約75%安く動かせます」
Introducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we’ve ever released.
— Claude (@claudeai) 2026年10月7日
On average, it costs around 75% less to run than Claude Haiku 4.5. pic.twitter.com/jm06cZJfkV
Claude PlatformとClaude Codeの両方で利用可能になっており、Opus 5.5やSonnet 5.5のサブエージェント(補助的に動く小さなAI)として組み合わせる使い方が想定されています。
要約・データベースへの問い合わせ・分類作業のような、量が多くて単純なタスクに向いているとAnthropic自身が説明しています。
とはいえ「75%安い」という数字だけでは、実際にどれだけ得なのかが分かりません。
価格表と性能データを確認してみました。
調べて分かったこと
価格は本当にどれくらい下がったのか
公式発表と海外メディアの報道を確認すると、価格の下がり方には幅があります。
- 入力トークン(100万トークンあたり):Haiku 4.5の1.00ドルから、0.10〜0.50ドルへ
- 出力トークン(100万トークンあたり):Haiku 4.5の5.00ドルから、0.50〜2.50ドルへ
- 10万トークンまでのリクエスト(Anthropicによれば、これまでのHaiku利用の約9割がこの範囲)は、価格が最大90%下がる計算です
Anthropicで実際にClaude Codeのサブエージェントとしての使い方を紹介しているチームも、同じ数字を公式に伝えています。
英訳: 「Haiku 5.5はClaude PlatformとClaude Codeで利用可能になりました。
平均してHaiku 4.5より約75%安く動かせます。
Opus 5.5やSonnet 5.5と組み合わせるサブエージェントとして相性が良く、要約・圧縮・データベースへの問い合わせのような、量が多くコストを抑えたい作業に向いています」
Haiku 5.5 is now available in the Claude Platform and Claude Code. On average, it costs around 75% less to run than Haiku 4.5.
— ClaudeDevs (@ClaudeDevs) 2026年10月7日
It pairs well with Opus 5.5 or Sonnet 5.5 as a subagent. Use it for high-volume, cost-sensitive tasks like summaries, compactions, or database queries. https://t.co/H7XCCT5F19 pic.twitter.com/RB9xCWo4Db
性能はどこまで伸びたのか
価格だけでなく、ベンチマーク(性能を測る共通テスト)の結果も公開されています。
パソコン操作の正答率を測る「OSWorld」では15.7%から72.4%へ、エージェント型のコーディング作業を測る「Terminal-Bench」では0%から39.2%へ、それぞれ大きく伸びました。
知識作業の難易度が高いテストでも、ツールを使わない状態で10.2%から45.9%へ、ツールを使った状態では18.7%から57.4%へ改善しています。
小型モデルという位置づけでありながら、前世代からの性能の伸び幅は値下げ幅と同じくらい大きい結果になっています。
「10倍安い」はどこまで本当か
価格と性能の良さを受けて、Anthropic社内からも歓迎する声が出ています。
Boris Chernyさんの投稿を見てみましょう。
英訳: 「Haiku 5.5はちゃんとしたHaikuです。
10万トークンのコンテキストでも、Haiku 4.5より10倍安くなります」
Haiku 5.5 is a good Haiku.
— Boris Cherny (@bcherny) 2026年10月7日
With 100k token context, it's also 10x cheaper than Haiku 4.5 https://t.co/Vzkq0AIQQz
ここで注意したいのが、Anthropic自身が明かしている但し書きです。
Haiku 5.5は更新されたトークナイザー(文章を処理単位に分割する仕組み)を使っており、同じ入力テキストでも消費するトークンの量がHaiku 4.5よりおよそ30%増えると、Anthropic公式の移行ガイドで明記されています(増加率は内容によって変わるとしています)。
1トークンあたりの値段は大きく下がったのに、1つの作業で使うトークンの数が増えれば、請求額の下がり方は広告されている割合より小さくなることがあるわけです。
「価格が10分の1」と「実際の支払いが10分の1」は、同じ意味ではない点は見落とされがちです。
Shiritomo編集部の考察:「安い」の中身を自分の作業で確かめる
AIツールをいくつも使い分けている人ほど、料金表の数字だけで乗り換えを決めがちです。
ただ今回のHaiku 5.5のように、単価が下がっても消費量側が変わるケースがあると分かると、見るべき指標は「1トークンの価格」ではなく「1つのタスクにかかった合計コスト」だということが分かります。
SNS運用や業務でAIを使い分けている人にとって、こうした「単価は下がったが消費量は増えた」という構造は、Haiku 5.5に限った話ではありません。
モデルの世代が変わるたびに、料金ページの数字だけでなく、実際に自分がよくやる作業をいくつか試して、トークン消費量と完了までの速さの両方を見ておくと、次にモデルを切り替えるときの判断材料になります。
まとめ
Claude Haiku 5.5は入力トークン最大90%・全体平均75%という大きな値下げと、OSWorldなどのベンチマークでの性能向上を同時に実現したモデルです。
ただし新しいトークナイザーの影響でトークン消費量がおよそ30%増えるとされており、価格表の割引率がそのまま請求額の下がり方になるとは限りません。
要約やデータベースへの問い合わせのような量の多い作業に使う人は、実際のタスクでコストを確かめてから本格的に切り替えるのが安心です。