Claude APIを使う開発者の多くは、軽い処理だけをHaikuモデルに任せている。要約やデータの仕分けはHaikuに、込み入った判断はSonnetやOpusに回す使い分けだ。安いぶん、複雑な作業までは頼れない。そう割り切ってきた人に向けて、Anthropicは2026年10月7日(米国時間)、新しい軽量モデル「Claude Haiku 5.5」を公開した。入力価格は条件によって最大10分の1まで下がった。同時に、ブラウザ操作やターミナル操作のような、これまでHaikuが苦手としてきた領域のベンチマークも大きく伸びている。
価格はどこまで下がったのか。浮いた分で何ができるようになるのか。そして、Haiku 4.5で動かしているコードはそのまま移せるのか。公式発表と価格ページの数字で確かめていく。
価格はどこまで下がったか
Haiku 5.5はプロンプトの長さで価格が2段階に分かれる。100万トークンあたり、10万トークン以下のプロンプトは入力$0.10・出力$0.50、10万トークンを超えると入力$0.50・出力$2.50になる。対してHaiku 4.5は長さに関わらず入力$1.00・出力$5.00のままだ。Anthropicの価格ページによると、Haiku 4.5宛てのリクエストの約9割は10万トークン以下だったという。多くの利用者は、入力・出力とも10分の1の単価になる計算だ。
入力価格だけで見ると、Haiku 5.5はSonnet 5.5の20分の1、Haiku 4.5の10分の1になる。ただし、この「10分の1」という数字をそのまま請求額の削減率として受け取ると、実際の請求書を見たときに拍子抜けすることになる。
実際の節約率はおよそ75%
自分は最初、見出しの「10分の1」をそのまま請求額の削減率だと思っていた。だが移行ガイドを読んで、話はそう単純ではないと気づいた。Haiku 5.5は、Claude 4.7以降と同じ新しいトークナイザーを使う。同じテキストでも、このトークナイザーはHaiku 4.5より約3割多くトークンを消費する。単価が10分の1に下がっても、トークン数そのものが増えるため、支払う金額は単価の下がり方よりゆるやかにしか減らない。
たとえばHaiku 4.5で8万トークンのプロンプトを処理していたとすると、同じ文章はHaiku 5.5では約10万4千トークンとして数えられる。単価は10分の1でも、処理量は1.3倍に増える。実際の支払いは、単価だけで計算した額よりいくらか高くなる。この影響を織り込んで、Anthropicは平均的な実行コストをHaiku 4.5比でおよそ75%の削減と試算している(Anthropic公式ブログ)。
つまり、見出しの「10分の1」は1トークンあたりの単価の話であり、実際の請求額はこれより緩やかに下がる。コストを見積もる際は、単価表の数字をそのまま掛け算しないほうがいい。
ベンチマークはどれだけ伸びたか
価格だけでなく、Anthropicが公開したベンチマークも大きく動いている。いずれもAnthropic自身が実施した評価で、第三者による再現ではない点を踏まえたうえで見ると、伸び幅の大きさが際立つ。
| ベンチマーク | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| OSWorld 2.1(オフライン) | 15.7% | 72.4% | 83.9% |
| Terminal-Bench 4.0 | 0.0% | 39.2% | 70.6% |
| Humanity’s Last Exam(ツールあり) | 18.7% | 57.4% | — |
| Chartography(ツールなし) | 6.4% | 46.4% | 61.6% |
とりわけ目を引くのはTerminal-Bench 4.0だ。Haiku 4.5は0.0%、つまりこのベンチマークが課すターミナル操作のタスクをほぼ一つもこなせなかった。Haiku 5.5はそこから39.2%まで伸びている。コンピュータの画面を操作するOSWorldも、15.7%から72.4%まで跳ね上がった。できなかったことが、できることに変わっている。
AnthropicはPC操作を代行する「computer use」と、ウェブページ操作用の「browser use」という2つのツールセットも用意した。どちらもHaiku 5.5から新たに使える。これまでこの種のツール操作は、Sonnet以上のモデルでなければ実用に耐えないとされてきた領域だ。
企業による推論評価でも、同様の報告がある。Anthropicによると、Asanaは自社のAIエージェント製品での評価で、タスク完了までのレイテンシが30%以上減った。Boxは初期テストでHaiku 4.5より11ポイント高いスコアを記録し、レイテンシは約半分だったという。これらはAnthropicが発表内で紹介した顧客の報告であり、本サイトが独立に確認した数値ではない。
effortで精度とコストを選べる
ベンチマークが伸びた背景には、Haiku系で初めて対応した「effort」という設定がある。これはモデルがどれだけ深く考えてから答えるかを、Low・Med・High・Xhigh・Maxの5段階で指定する仕組みだ。段階を上げるほど精度は上がるが、トークン消費と応答時間も増える。
Haiku 4.5までは、thinking(内部での思考過程)を有効にするかどうかと、その上限トークン数を指定する方式だった。Haiku 5.5ではthinkingをadaptiveに設定し、必要な思考の深さをeffortの段階で選ぶ方式に変わった(移行ガイド)。要約やルーティングのような軽い処理にはeffortを低く、エージェント的な複数手順の作業には高く。モデルを切り替えずに、1つのモデルの中でこの調整ができるようになった。
移行で変わるAPIの挙動
Haiku 4.5からHaiku 5.5へコードを移す場合、価格やeffort以外にも確認すべき変更がある。移行ガイドが挙げる主な破壊的変更は次のとおりだ。
thinkingに{"type": "enabled", "budget_tokens": N}を送っていたコードはエラーになる。{"type": "adaptive"}とeffortの指定に書き換える必要があるtemperature・top_p・top_kは指定できない。値を送ると原則400エラーになる- 会話の最後をassistantの発言で終える「prefill」はできない。必ずuser発言で終える必要がある
- computer useツールは
computer_20250124からcomputer_toolset_20260801という新しいツールセットに変わった
これらはどれも、モデルIDを書き換えるだけでは気づきにくい変更だ。価格表だけを見てHaiku 5.5に切り替えると、thinkingやサンプリングパラメータまわりでリクエストがエラーになる可能性がある。
まとめ
Claude Haiku 5.5は、短いプロンプトなら入力・出力とも単価が10分の1になる。新しいトークナイザーの影響で、実際の節約率はAnthropicの試算でおよそ75%だ。その代わり、Terminal-Bench 4.0が0.0%から39.2%になるなど、以前はHaikuでは歯が立たなかった領域のベンチマークが大きく伸びた。PC操作・ブラウザ操作のツールセットも新たに使えるようになっている。
effort設定でコストと精度のバランスを選べる点も合わせると、「安いが単純作業向け」という評価そのものを見直す材料がそろった発表だと言える。既存のHaiku 4.5のコードを移す場合は、価格表だけでなくthinkingの指定方法やサンプリングパラメータの扱いも確認したい。移行ガイドを見てから切り替えるのが確実だ。
コメント
気づきや感想をどうぞ記事への補足や、読んで考えたことをお寄せください。個人情報や、他の人を傷つける内容の投稿はお控えください。
投稿にはGoogleログインが必要です。
Googleでログイン投稿にはGoogleアカウントの表示名が公開されます。メールアドレスは取得・公開しません。
コメントを読み込んでいます…