Litmus — 話題のニュースを、深く読み解く。 RSS
AI

Claude Haiku 5.5、入力価格を最大10分の1に値下げ

AnthropicがAPI向け軽量モデル「Claude Haiku 5.5」を公開した。価格は条件により最大10分の1、ベンチマークはブラウザ操作などで大きく伸び、コストと精度を選べるeffort設定も加わった。

青い光に照らされたサーバーラックの通気孔を正面から撮った写真

イメージ写真 記事の内容を撮影したものではありません。Photo by panumas nikhomkhai on Pexels

この記事には Amazon アソシエイトのリンクを含みます。

Claude APIを使う開発者の多くは、軽い処理だけをHaikuモデルに任せている。要約やデータの仕分けはHaikuに、込み入った判断はSonnetやOpusに回す使い分けだ。安いぶん、複雑な作業までは頼れない。そう割り切ってきた人に向けて、Anthropicは2026年10月7日(米国時間)、新しい軽量モデル「Claude Haiku 5.5」を公開した。入力価格は条件によって最大10分の1まで下がった。同時に、ブラウザ操作やターミナル操作のような、これまでHaikuが苦手としてきた領域のベンチマークも大きく伸びている。

価格はどこまで下がったのか。浮いた分で何ができるようになるのか。そして、Haiku 4.5で動かしているコードはそのまま移せるのか。公式発表と価格ページの数字で確かめていく。

価格はどこまで下がったか

Haiku 5.5はプロンプトの長さで価格が2段階に分かれる。100万トークンあたり、10万トークン以下のプロンプトは入力$0.10・出力$0.50、10万トークンを超えると入力$0.50・出力$2.50になる。対してHaiku 4.5は長さに関わらず入力$1.00・出力$5.00のままだ。Anthropicの価格ページによると、Haiku 4.5宛てのリクエストの約9割は10万トークン以下だったという。多くの利用者は、入力・出力とも10分の1の単価になる計算だ。

0.00.51.01.52.0ドル/100万トークンSonnet 5.5: 2.00Haiku 4.5: 1.00Haiku 5.5(10万以下): 0.102.001.000.10Sonnet 5.5Haiku 4.5Haiku 5.5(10万以下)

入力価格だけで見ると、Haiku 5.5はSonnet 5.5の20分の1、Haiku 4.5の10分の1になる。ただし、この「10分の1」という数字をそのまま請求額の削減率として受け取ると、実際の請求書を見たときに拍子抜けすることになる。

実際の節約率はおよそ75%

自分は最初、見出しの「10分の1」をそのまま請求額の削減率だと思っていた。だが移行ガイドを読んで、話はそう単純ではないと気づいた。Haiku 5.5は、Claude 4.7以降と同じ新しいトークナイザーを使う。同じテキストでも、このトークナイザーはHaiku 4.5より約3割多くトークンを消費する。単価が10分の1に下がっても、トークン数そのものが増えるため、支払う金額は単価の下がり方よりゆるやかにしか減らない。

たとえばHaiku 4.5で8万トークンのプロンプトを処理していたとすると、同じ文章はHaiku 5.5では約10万4千トークンとして数えられる。単価は10分の1でも、処理量は1.3倍に増える。実際の支払いは、単価だけで計算した額よりいくらか高くなる。この影響を織り込んで、Anthropicは平均的な実行コストをHaiku 4.5比でおよそ75%の削減と試算している(Anthropic公式ブログ)。

つまり、見出しの「10分の1」は1トークンあたりの単価の話であり、実際の請求額はこれより緩やかに下がる。コストを見積もる際は、単価表の数字をそのまま掛け算しないほうがいい。

ベンチマークはどれだけ伸びたか

価格だけでなく、Anthropicが公開したベンチマークも大きく動いている。いずれもAnthropic自身が実施した評価で、第三者による再現ではない点を踏まえたうえで見ると、伸び幅の大きさが際立つ。

ベンチマークHaiku 4.5Haiku 5.5Sonnet 5.5
OSWorld 2.1(オフライン)15.7%72.4%83.9%
Terminal-Bench 4.00.0%39.2%70.6%
Humanity’s Last Exam(ツールあり)18.7%57.4%—
Chartography(ツールなし)6.4%46.4%61.6%

とりわけ目を引くのはTerminal-Bench 4.0だ。Haiku 4.5は0.0%、つまりこのベンチマークが課すターミナル操作のタスクをほぼ一つもこなせなかった。Haiku 5.5はそこから39.2%まで伸びている。コンピュータの画面を操作するOSWorldも、15.7%から72.4%まで跳ね上がった。できなかったことが、できることに変わっている。

AnthropicはPC操作を代行する「computer use」と、ウェブページ操作用の「browser use」という2つのツールセットも用意した。どちらもHaiku 5.5から新たに使える。これまでこの種のツール操作は、Sonnet以上のモデルでなければ実用に耐えないとされてきた領域だ。

企業による推論評価でも、同様の報告がある。Anthropicによると、Asanaは自社のAIエージェント製品での評価で、タスク完了までのレイテンシが30%以上減った。Boxは初期テストでHaiku 4.5より11ポイント高いスコアを記録し、レイテンシは約半分だったという。これらはAnthropicが発表内で紹介した顧客の報告であり、本サイトが独立に確認した数値ではない。

effortで精度とコストを選べる

ベンチマークが伸びた背景には、Haiku系で初めて対応した「effort」という設定がある。これはモデルがどれだけ深く考えてから答えるかを、Low・Med・High・Xhigh・Maxの5段階で指定する仕組みだ。段階を上げるほど精度は上がるが、トークン消費と応答時間も増える。

Haiku 4.5までは、thinking(内部での思考過程)を有効にするかどうかと、その上限トークン数を指定する方式だった。Haiku 5.5ではthinkingをadaptiveに設定し、必要な思考の深さをeffortの段階で選ぶ方式に変わった(移行ガイド)。要約やルーティングのような軽い処理にはeffortを低く、エージェント的な複数手順の作業には高く。モデルを切り替えずに、1つのモデルの中でこの調整ができるようになった。

移行で変わるAPIの挙動

Haiku 4.5からHaiku 5.5へコードを移す場合、価格やeffort以外にも確認すべき変更がある。移行ガイドが挙げる主な破壊的変更は次のとおりだ。

  • thinkingに{"type": "enabled", "budget_tokens": N}を送っていたコードはエラーになる。{"type": "adaptive"}とeffortの指定に書き換える必要がある
  • temperature・top_p・top_kは指定できない。値を送ると原則400エラーになる
  • 会話の最後をassistantの発言で終える「prefill」はできない。必ずuser発言で終える必要がある
  • computer useツールはcomputer_20250124からcomputer_toolset_20260801という新しいツールセットに変わった

これらはどれも、モデルIDを書き換えるだけでは気づきにくい変更だ。価格表だけを見てHaiku 5.5に切り替えると、thinkingやサンプリングパラメータまわりでリクエストがエラーになる可能性がある。

まとめ

Claude Haiku 5.5は、短いプロンプトなら入力・出力とも単価が10分の1になる。新しいトークナイザーの影響で、実際の節約率はAnthropicの試算でおよそ75%だ。その代わり、Terminal-Bench 4.0が0.0%から39.2%になるなど、以前はHaikuでは歯が立たなかった領域のベンチマークが大きく伸びた。PC操作・ブラウザ操作のツールセットも新たに使えるようになっている。

effort設定でコストと精度のバランスを選べる点も合わせると、「安いが単純作業向け」という評価そのものを見直す材料がそろった発表だと言える。既存のHaiku 4.5のコードを移す場合は、価格表だけでなくthinkingの指定方法やサンプリングパラメータの扱いも確認したい。移行ガイドを見てから切り替えるのが確実だ。

この記事の先を読む本を探す

特定の本を勧めるものではありません。検索結果から、いまの版と目次を確かめて選んでください。

コメント

気づきや感想をどうぞ

記事への補足や、読んで考えたことをお寄せください。個人情報や、他の人を傷つける内容の投稿はお控えください。

コメントを読み込んでいます…

    ほかの記事

    最新の記事 →