Litmus — 話題のニュースを、深く読み解く。 RSS
AI

Claude Sonnet 5.5、ターミナル作業でOpusを上回る

Anthropicが2026年9月28日に公開したClaude Sonnet 5.5は、ターミナル操作の指標でOpus 5.5を上回った。価格は据え置きのまま、同じ作業のコストは最大3割下がる。

暗い画面いっぱいに表示された、緑や紫のシンタックスハイライトが付いたプログラムコードのクローズアップ写真

イメージ写真 記事の内容を撮影したものではありません。Photo by Godfrey Atima on Pexels

この記事には Amazon アソシエイトのリンクを含みます。

Claude Codeでエージェントにターミナル越しの作業を任せるとき、モデルを選ぶ画面で指が止まる。上に並ぶOpusにすれば安心だが、料金は下のSonnetより高い。2026年9月28日、Anthropicが新しいSonnetを公開した。公式ページのベンチマーク表を並べて読むと、ターミナル操作を測る指標だけ、安いはずのSonnetの数字がOpusを超えていた。

公式発表のベンチマーク表を読むと、どの指標で逆転が起きたのか、他の指標ではどちらが優位なのか、料金と速度は何が変わったのかが分かる。

何が発表されたのか

Anthropicは2026年9月28日(米国時間)、「Claude Sonnet 5.5」を公開した。公式発表によると、Claude Platform・API・Amazon Web Services・Google Cloud・Microsoft Azureのすべてで即日利用できる。窓の杜の報道によれば、無料プランを含む全プランで使えるという。APIのモデル名はclaude-sonnet-5-5で、既存のコードは呼び出す文字列を変えるだけで切り替えられる。

料金は前世代のSonnet 5から据え置かれた。100万トークンあたり入力2ドル・出力10ドル・キャッシュ読み込み0.20ドルで、上位モデルのOpus 5.5(入力4ドル・出力20ドル)よりもともと安い。今回、この価格差に加えて性能面でも気になる変化が起きた。前のSonnet 5と比べて、どれくらい伸びたのか。

ターミナル作業の指標で何が起きたのか

Anthropicの公式ページには、Sonnet 5.5・Sonnet 5・Opus 5.5の3モデルを並べたベンチマーク表がある。そのなかの「Terminal-Bench 4.0」という指標を見て、自分は表を二度見した。ターミナル越しにコマンドを実行させ、目的のタスクを最後までやり遂げられるかを測る指標で、Claude Codeのようなエージェントの実力に直結する。

020406080Sonnet 5: 10.3Sonnet 5.5: 70.6Opus 5.5: 66.410.370.666.4Sonnet 5Sonnet 5.5Opus 5.5%

数字が示す通り、Sonnet 5の10.3%からSonnet 5.5は70.6%まで伸びた。それだけでも7倍近い伸びだが、驚いたのはその先だ。上位モデルであるはずのOpus 5.5は66.4%にとどまっている。公式ページの脚注によれば、この66.4%はOpus 5.5を「Xhigh」という高い思考量の設定で動かした時点の数値だ。それでも、安いSonnet 5.5のほうが数字の上では上回っている。ターミナル作業に限れば、性能の順位が価格の順位をひっくり返した形だ。

他の指標でも同じ傾向か

この逆転がSonnet 5.5の全面的な優位を意味するわけではない。同じ公式ページに載っている他の指標を並べると、Opus 5.5が上回ったままの項目のほうが多い。

指標何を測るかSonnet 5Sonnet 5.5Opus 5.5
GDPval-AA v2.1実務作業の再現度(指数)144918441846
AA-Briefcase v1.1資料調査タスク(指数)135918111822
Humanity’s Last Exam専門知識を要する設問への正答率54.9%64.5%67.7%
OSWorld 2.1GUI操作を伴うタスクの達成率57.0%80.1%81.8%
FrontierCode 1.1コーディング課題の達成率42.4%46.2%54.4%
CursorBench 4.0エディタ上でのコード編集タスク34.1%55.5%57.8%

この表から分かるのは、Sonnet 5.5がSonnet 5より全指標で伸びている一方、Opus 5.5との差はTerminal-Bench 4.0以外では埋まっていないことだ。とくにHumanity’s Last ExamやOSWorldのように、専門知識やGUI操作を含む幅広いタスクほど、Opusの優位が残る。

なぜTerminal-Bench 4.0だけ逆転したのかは、Anthropicの発表資料からは読み取れない。

裏を返せば、使い分けの目安はこうなる。ファイル操作やコマンド実行が中心のタスクならSonnet 5.5で足りる。専門知識の調査やGUIを含む複雑な作業では、Opus 5.5を選ぶ理由がまだ残っている。

料金と速度はどう変わるのか

性能だけでなく、実行そのものも変わった。ITmedia NEWSの報道によると、Sonnet 5.5はSonnet 5と比べて出力速度が30%以上速くなった。料金は据え置きだが、同じ作業をこなすのに必要なトークン数が減ったため、Anthropicのテストではタスクあたりのコストが最大30%下がったという。

つまり、Sonnet 5.5に切り替えると「同じ料金体系のまま速くなり、実質の支払いも減る」状態になる。ターミナル作業でOpus 5.5に匹敵する数字が出ているぶん、日常的にClaude Codeを使っている人ほど、切り替えの効果を体感しやすいはずだ。

なお、本サイトがOpus 5.5を取り上げた記事では、「Sonnet 5.5・Haiku 5.5も続く見込みだが、価格・性能はまだ未発表」と書いていた。今回の発表で、Sonnet 5.5の価格と性能が明らかになった。Haiku 5.5については、Anthropicが「今後数週間で」提供するとしており、価格・性能はまだ公表されていない。

まとめ

2026年9月28日に公開されたClaude Sonnet 5.5は、無料プランを含む全プラン・API・主要クラウドで即日利用できる。もっとも意外だったのは、ターミナル操作を測るTerminal-Bench 4.0で、Sonnet 5.5(70.6%)が上位モデルのOpus 5.5(66.4%)を上回っていたことだ。

ただしGDPval-AAやHumanity’s Last Examなど、専門知識やGUI操作を含む指標ではOpus 5.5が依然として上回っている。料金はSonnet 5から据え置きのまま、同じ作業のコストは最大30%下がり、出力速度も30%以上速くなった。

Claude Codeでのターミナル中心の作業ならSonnet 5.5で足りる場面が広がる。専門知識を要する調査や複雑なコーディングでは、引き続きOpusへの切り替えを検討する価値がある。

この記事の先を読む本を探す

特定の本を勧めるものではありません。検索結果から、いまの版と目次を確かめて選んでください。

コメント

気づきや感想をどうぞ

記事への補足や、読んで考えたことをお寄せください。個人情報や、他の人を傷つける内容の投稿はお控えください。

コメントを読み込んでいます…

    ほかの記事

    最新の記事 →