AI開発コネクト
AI最新ニュースChatGPT・OpenAI

OpenAIが速度を有料ティア化。同じモデルが料金6倍、見積書に速度の行が要る

OpenAIがDevDay 2026で高速ティアUltrafastを発表。同じGPT-6 Astraが入力$10→$60、出力$50→$300と6倍になります。速度が独立した課金項目になった今、見積書のAI利用料に何を書かせるかを整理します。

公開: 2026.09.30 / 更新: 2026.09.30

見積書に「使用するモデル」が書かれるようになったのは、ここ 1 年ほどの変化である。だが**「どの速さで使うか」**を書いた見積書は、まだほとんど見ない。2026 年 9 月 29 日の発表で、その空欄が実際の金額差になった。

同じ荷物を運ぶ2本の搬送ベルトと、6つの分銅で沈んだ秤

公表されている事実

OpenAI は 2026 年 9 月 29 日(米サンフランシスコ時間)、年次開発者会議「DevDay 2026」で 20 件以上の新製品・新機能を発表した。費用に直接効くものを挙げる。

Ultrafast(高速ティア)

  • Codex で最大 8 倍(毎秒約 300 トークン)、API で最大 6 倍の生成速度
  • API の料金表では、GPT-6 Astra の標準ティアが 100 万トークンあたり入力 $10 / 出力 $50、Ultrafast ティアが入力 $60 / 出力 $300。キャッシュ入力も $1 → $6 で、いずれも 6 倍
  • 料金表に Ultrafast の価格が載っているのは、現時点では GPT-6 Astra だけ。Sol 版は「近日」とされている
  • 提供先は API と、新設の Pro 500(ChatGPT Plus の 25 倍の利用枠)、Enterprise 向けの ChatGPT Work と Codex

GPT-6.1 Sol

  • 標準の入力 $2 / 出力 $10 は GPT-6 Sol と同じ。キャッシュ入力が $0.20 から $0.10 へ半減
  • エージェント的なコーディング・コンピュータ操作・専門業務の性能を強化。標準のトークン単価は Astra の 5 分の 1

Decisions API

  • GPT-6 Luna を使い、あらかじめ定義した有限の選択肢から答えを返す。分類・スコアリング・可否判定に向く
  • 通常の Luna API が約 1.6 秒かかる判定を約 150 ミリ秒で返す(およそ 10 分の 1)
  • 限定プレビューで、一般提供は近日とされている

その他

  • Agents API がパブリックベータ。エージェントがソフトウェアの UI をそのまま操作する computer use に対応
  • Codex Security Cloud が GitHub リポジトリを随時・定期にスキャンし、重複を除いて修正案まで用意する
  • 24 時間稼働するエージェント「dots」は、欧州経済領域(EEA)・スイス・英国を除く地域で提供される

なお料金表の「短コンテキスト」は入力 272K トークン以下を指し、それを超えると別単価になる。

論点 1. 速度が「性能」ではなく「単価」の欄に移った

これまで、応答が速いかどうかはモデルの性能の一部だった。速いモデルはおおむね小さく、小さいモデルは安い。だから「速い=安い」の向きにそろっていた。

Ultrafast はこれを分ける。同じ GPT-6 Astra が、同じ品質のまま 6 倍の単価で速く動く。速度が、モデル選定とは独立した課金項目になったということである。

見積書の書き方として何が困るかというと、「GPT-6 Astra を使用」とだけ書かれた行が、$10 の行なのか $60 の行なのか判別できない点である。月に 100 万トークンを出力する程度の規模でも、標準なら $50、Ultrafast なら $300。差は月 $250、年間で約 45 万円になる(1 ドル 150 円換算)。処理量が一桁増えれば、差も一桁増える。

論点 2. 「全部に一番よいモデル」は、設計としてもう高すぎる

Decisions API の存在は、逆から読むと分かりやすい。判定と生成は別の作業であり、別の単価で買えるという主張である。

同じ処理を単価だけで並べると、こうなる。

用途 使うもの 入力 $/100万トークン 出力 $/100万トークン
可否判定・分類 GPT-6 Luna 0.10 0.50
一般的な生成 GPT-6.1 Sol 2 10
難しい推論 GPT-6 Astra(標準) 10 50
速さが要る場面 GPT-6 Astra(Ultrafast) 60 300

上と下では、入力も出力も 600 倍の開きがある。実際の処理の多くは「この問い合わせは返金の話か、解約の話か」といった判定であり、そこに最上位のモデルを最速ティアで当てる理由はない。

つまり、これからの見積書で見るべきは単価そのものではなく、処理を単価の違う層にどう割り振る設計になっているかである。単価表だけを見て安い会社を選んでも、すべてを上の層で処理する設計なら総額は逆転する。この構造はOpenAIがGPT-6 Sol・Lunaを公開。API単価が半額でも総額が下がらない理由で書いたことの続きにあたる。

論点 3. 使える機能が地域で違う

dots が EEA・スイス・英国から外れている点は、機能の話に見えて契約の話である。提案の中核に据えた機能が、海外拠点や欧州向けのサービスでは使えないという事態が普通に起きる。

提案を受けるときは、「その機能は、当社が使う国・提供する国で利用できるか」を確認する必要がある。提供元の都合で後から変わりうるため、変わったときに誰が代替案を出すかまで決めておきたい。

発注者・企業への影響

第一に、見積書の AI 利用料の行に「速度ティア」を書かせる必要がある。モデル名だけでは金額が確定しない。標準か Ultrafast か、Ultrafast を使うならどの処理に限るのかを明示させる。

第二に、速さを要件にするかどうかは発注側が決める。対話型の画面で人が待つ処理なら速度に価値があるが、夜間のバッチ処理や社内向けの集計に 6 倍を払う理由はない。要件として書いていないのに速いティアが積まれていれば、それは削れる。逆に「速度は重要」と口頭で伝えただけだと、後から追加費用になりやすい。

第三に、運用費の見積もりを従量で置き直す。単価が階層化したことで、「AI 利用料 月額○万円」の一行では中身が分からなくなった。処理の種類ごとにどの層を使い、月に何回・何トークン走るのかを積み上げた根拠を求めたい。考え方はAI運用費は定額保守か従量精算かに整理している。分野別の相場感はAI開発の費用相場にある。

第四に、単価改定への追随を契約に書く。単価表は構造ごと変わりうる。改定時に誰が影響を試算し、誰が設計変更の費用を持つのかを決めていない契約は、そのたびにもめる。

見積書で確認する 3 点

  1. 速度ティアの明示。標準か Ultrafast か。Ultrafast を使うなら、どの処理に、なぜ必要か
  2. 処理と単価層の対応表。判定・分類・生成・推論のそれぞれにどのモデルを割り当てるか。月あたりの想定回数とトークン数
  3. 地域制限。提案に含まれる機能が、自社の利用地域・提供地域で使えるか。使えなくなった場合に誰が代替案を出すか

手元の見積書がこの 3 点に答えているかは見積書チェックで項目ごとに確認できる。同じ条件で複数社に聞きたい場合は、無料で相見積もりから案件票を作れば、各社が同じ項目で回答する。

まとめ

DevDay 2026 で起きたのは、性能競争というより課金の軸が増えたことである。モデルの大きさに加えて速さが独立した単価になり、判定専用の安い経路も用意された。発注側がやるべきは新しいモデル名を覚えることではなく、自社の処理を単価の違う層に仕分けられる状態にしておくことだと考えられる。仕分けができていれば、単価表がまた変わっても、影響の計算は同じやり方で済む。

参考・出典

AI開発の見積もりを、同じ条件で比べる。

条件を整理した 1 枚の案件票で複数のAI開発会社に依頼。初期費用だけでなく、データ整備・API 費・精度検証・保守・権利まで同じ列で比較できます。

無料で相見積もりを始める →
無料で相見積もり30秒で費用診断