Litmus — 話題のニュースを、深く読み解く。 RSS
AI

OpenAIの「Decisions API」、文章を生成せず判定を返す

OpenAIが判定専用の新API「Decisions API」を公開した。質問の型は先行する判定AI「Jev」とほぼ同じ発想だが、通信規格には互換性がなく、価格も既存勢の間に収まっている。

青い光に照らされたデータセンターのサーバー機材

イメージ写真 記事の内容を撮影したものではありません。Photo by panumas nikhomkhai on Pexels

この記事には Amazon アソシエイトのリンクを含みます。

問い合わせメールが届いたら、まず「営業」「サポート」「その他」のどこへ振り分けるかだけを機械に決めさせたい。そんなとき、ふつうの対話型AIに聞くと、答えの文章を書き終えるまで待たされるうえ、返ってくる形も毎回少しずつ違う。

この不満に答える「判定だけを即答するAI」を、本サイトはこれまで3回扱ってきた。Jev、その無料版「Laya」、Cloudflareの「Clef」だ。2026年10月6日(米国時間)、ここに最大手のOpenAIが加わった。公式ドキュメントによると、新しい「Decisions API」はパブリックベータとして全開発者に公開され、文章を一切生成せず判定を返す。質問の分け方は先行する決定モデルと驚くほど近いが、仕組みと値段には既存勢との違いがある。

Decisions APIは何を返すのか

Decisions APIへのリクエストは3つの要素でできている。判定に使うモデル(現時点では、GPT-6の軽量・低価格版gpt-6-lunaのみ)、全質問で共有する根拠(テキストまたは画像を含む入力)、そして質問そのものだ。これを専用のエンドポイントPOST /v1/decisionsに送る(OpenAI公式ドキュメント)。

質問の型は3種類ある。

  • predicate: 条件が真である確率を0〜1の数値で返す。「製品に目に見える破損があるか」のような真偽判定
  • choice: 用意した選択肢から1つを選ぶ。各選択肢の確率と確信度も一緒に返る。公式ドキュメントの例は「請求・技術サポート・配送・その他」から問い合わせの担当を選ぶというものだ
  • score: 順序のあるレベルに対する評価を返す。確率で重み付けした平均なので、「1.1」のような段階の間の値になることもある

いずれも公式ドキュメントに載っている例だ(OpenAI公式ドキュメント)。画像を渡す場合は、データそのものを埋め込んだbase64形式に限られる。画像が置いてあるWebページのURLをそのまま渡す方法は使えない(同ドキュメント)。複数の質問は1回のリクエストにまとめられるが、前の答えによって次の質問を変えたい場合は、リクエストを分ける必要がある。

ここまでの設計を見て、既存のJevを知っている読者なら気づくことがあるはずだ。

発想は同じでも規格は別

Jevは2026年9月15日の発表時点で、質問をChoice(選択肢)・Score(採点)・Noul(真偽判定)の3種類に分けていた(TypeSafe AI公式ブログ)。OpenAIのpredicate/choice/scoreと並べると、Noulとpredicateが同じ役割で、choiceとscoreはほぼ同名だ。文章を生成せず、質問を3つの型に絞って並列に答える考え方そのものは、もう業界の共通認識になりつつあるとみてよさそうだ。

ところが、この2つのAPIを同じコードから呼び分けることはできない。Jevの通信規格はPOST /v1/systemoneだ。後発のCloudflare「Clef」もConvaiの「Laya」も、この規格にそのまま乗った(Cloudflare公式ブログ)。JevやLayaを呼んでいたコードは、送信先をClefに変えるだけでほぼそのまま動く設計になっている。

Jev・Clef・Layaと3回続けてこの系譜を追ってきた身としては、最大手が参入するなら当然この共通規格に乗ってくるだろうと予想していた。ところが、OpenAIだけは、ここに合流しなかった。エンドポイント名も、リクエストの形も、Jev系とは別物として作られている。OpenAI公式ドキュメントにも、GIGAZINEの報道にも、JevやClefへの言及は見当たらない(OpenAI公式ドキュメント、GIGAZINE)。なぜ独自規格にしたのかは、OpenAI自身が説明していないので分からない。ただ、質問の分け方という「考え方」は業界で揃ってきている一方、呼び出し方という「規格」はまだ1つにまとまっていない、という事実は見えてくる。

考え方は似ていても、使う側にとって一番気になるのは速さと値段のはずだ。

価格はJevとClefの間

性能について、OpenAI公式ドキュメントは「Responses API経由の通常のGPT-6 Luna呼び出しに比べて約10倍速い」としている(同ドキュメント)。具体的な遅延時間や測定条件の記載はなく、独立した検証も今のところ見当たらない。この「10倍」は、あくまでOpenAI自身のGPT-6 Luna同士の比較だ。JevやClefとの速度比較ではない点には注意が要る。測定の基準点がそれぞれ違うため、4社の体感速度を単純に並べることはできない。

一方、価格は4社とも「出力課金なしの入力トークン単価」という同じ形で発表しているため、ここは比較できる。

0.000.050.100.150.200.25ドル / 100万トークンJev: 0.042OpenAI Decisions API: 0.10Clef: 0.240.0420.100.24JevOpenAI Decisions APIClef

OpenAIのDecisions APIは、入力100万トークンあたり0.10ドル(OpenAI公式ドキュメント)。先発のJevは0.042ドル(TypeSafe AI公式ブログ)、後発のClefは0.24ドル(Cloudflare公式ブログ)だった。Decisions APIはちょうどその中間に収まる。文章を生成しないという設計はどの社も共通していて、だからこそ4社とも出力側の課金そのものが存在しない。なお無料のオープンウェイトモデルLayaは、自分のマシンで動かす分には課金が発生しない。

価格を比べたところで、実際にどれを選べばいいのかが次の疑問になる。

何を基準に選ぶか

対応モデルで見ると、Decisions APIは現時点でGPT-6 Lunaのみに絞られている(OpenAI公式ドキュメント)。すでにOpenAIのAPIを使っていて、ほかのモデルへ切り替える予定がないなら、追加の契約なしに試せる選択肢が増えたことになる。

4社を並べると、次のようになる。

質問の型通信規格画像・動画ライセンス
JevChoice / Score / Noul/v1/systemone非対応(テキストのみ)クローズド
LayaChoice / Score / Noul(Jev互換)/v1/systemone非対応(テキストのみ)オープンウェイト(Apache-2.0)
Clefchoice / score / noul(Jev互換)/v1/systemone画像(最大4枚)・動画オープンウェイト(Apache-2.0)
OpenAI Decisions APIpredicate / choice / score/v1/decisions画像のみ(インラインbase64限定)クローズド

表にすると、OpenAIが唯一、既存の通信規格に乗らなかった立場であることがはっきりする。選ぶ基準は、手元の事情に合わせて次のように分かれる。

  • 自分のサーバーで重みごと動かしたい → LayaかClef
  • 画像・動画まで含めて判定させたい → Clef
  • すでにOpenAIのAPIキーで運用していて、まず試したい → Decisions API

Decisions APIはまだパブリックベータで、一般提供は「数週間以内」の予定とされている(OpenAI公式ドキュメント)。GIGAZINEの報道によれば、元OpenAI社員のEthan Kam氏が1週間以上試用した(GIGAZINE)。同氏は「これまで実用的でなかった用途が多く見つかった」と評価しているという。ベータ期間中は、価格や対応モデルの範囲が変わる可能性がある点を踏まえて試すことになる。

まとめ

OpenAIが公開した「Decisions API」は、文章を生成せず3種類の判定(真偽の確率・選択肢・採点)を返す専用エンドポイントだ。質問の分け方はJevが先に定義した3つの型とほぼ同じ発想だが、通信規格には互換性がない。Jev・Laya・Clefが共有してきた/v1/systemoneには合流しなかった。

価格は入力100万トークンあたり0.10ドルで、Jevの0.042ドルとClefの0.24ドルの間に位置する。対応モデルは今のところGPT-6 Lunaのみで、一般提供は数週間以内の予定だ。判定だけを高速にこなしたい場面では、クローズドAPIとオープンウェイトの両方から選べる状況になっている。

この記事の先を読む本を探す

特定の本を勧めるものではありません。検索結果から、いまの版と目次を確かめて選んでください。

コメント

気づきや感想をどうぞ

記事への補足や、読んで考えたことをお寄せください。個人情報や、他の人を傷つける内容の投稿はお控えください。

コメントを読み込んでいます…

    ほかの記事

    最新の記事 →