本文へ移動
LIFEMAKERS.COM — 自立型ライフの実践知カタログ
ベータ版
Signal解説・分析テクノロジーと道具FUTURE LIFE BRIEF

最大8倍速の GPT-6.1 Sol は誰の待ち時間を減らすか

OpenAI が GPT-6.1 Sol に最大8倍速の Ultrafast を追加した。API 料金は標準の6倍、Codex では月500ドルの Pro から。速さが効く作業と効かない作業を見分ける。

最大8倍速の GPT-6.1 Sol は誰の待ち時間を減らすかのイメージ

この記事でわかること

  • OpenAI が GPT-6.1 Sol を最大8倍速く動かす Ultrafast を API・Codex・ChatGPT Work で提供開始
  • API 料金は標準の6倍 (出力100万トークン60ドル)。Codex では月500ドルの Pro プランからで、利用枠は8倍の割合で減る
  • 速くなるのはモデルの生成部分。画面の前で待つ作業に効き、夜間の一括処理は半額の Batch・Flex が合う

OpenAI は日本時間10月9日、GPT-6.1 Sol を最大8倍の速さで動かす Ultrafast の提供を、API と Codex、ChatGPT Work で順に始めた。速さの代わりに API の料金は標準の6倍で、個人が Codex で使えるのは月500ドルの Pro プランからになる。

AI に作業を任せる人にとっては、待ち時間をいくらで買うかを作業ごとに決める選択肢が一つ増えた話だ。

速くなるのは、モデルが答えを書き出す時間

OpenAI の開発者向け公式アカウントによると、Ultrafast は GPT-6.1 Sol の標準モードに比べて最大8倍速く、性能は上位モデルの GPT-6 Astra に近いという。API の公式ドキュメントでは、リクエストの処理区分を指定する項目 (service_tier) に ultrafast と書けば切り替わる。API の利用者なら誰でも使え、レートの上限は標準モードとは別に設けられている。

範囲は正確にしておきたい。速くなるのは、モデルがトークンを生成する速さだ。テストの実行やファイルの読み書きなど、モデルの外で起きる待ち時間はこのモードの対象に入っていない。OpenAI 自身もドキュメントで、道具の呼び出しを細かく繰り返す使い方では接続のたびにかかる通信の手間が速度の伸びを削りうるとして、接続を張ったままにする WebSocket を強く勧めている。「最大8倍」は、条件がそろったときの上限だ。

API の料金で見る、速さの4段階

API の料金は、GPT-6.1 Sol の標準で入力100万トークンあたり2ドル、出力10ドル。Ultrafast はその6倍で、入力12ドル、出力60ドルになる (入力が27万2,000トークン以下の場合)。出力の単価は、上位の GPT-6 Astra を標準で使うときの50ドルより高い。

これで同じモデルの使い方は、急がない処理を後回しにして安くする Batch と Flex (標準の半額)、標準、Fast (2倍)、Ultrafast (6倍) の4段になった。急がない仕事は半額で、急ぐ仕事は6倍で。待ち時間に払う額を、使う側が選ぶ形だ。

個人の手元に届く入口は、まだ狭い

Codex と ChatGPT Work で使えるのは、提供開始の時点では月500ドルの Pro プランと、条件を満たす企業向け・教育機関向けのプランに限られる。ほかの個人向けプランは、クレジットを追加で買っても使えない。企業向けでは既定でオフになっていて、管理者が許可した人から使える。

お金の減り方にも注意が要る。Pro 500ドルに付いてくる利用枠は、Ultrafast で使うと標準の8倍の割合で減っていく。単純に割れば、同じ枠で進められる作業量は標準の8分の1だ。枠を使い切ったあとは、買ったクレジットから標準の6倍の割合で引かれる。速さを常にオンにしておくと、月の途中で枠が尽きる使い方になりかねない。

待っている時間は、作業のどこにあるか

効くのは、人が画面の前で答えを待っている作業だ。コードを直してはすぐ確かめる往復や、文章の手直しを何度も頼むやり取り。返事が速いほど、考えが途切れないまま次の指示を出せる。

反対に、寝ている間に回す一括処理や、終わったら通知が来れば足りる作業では、速さに払う意味は小さい。そこは半額の Batch や Flex のほうが合う。待ち時間の多くがテストの実行やファイルの処理なら、モデルだけを速くしても全体はあまり縮まらない。

この先数週間で見ておきたいのは、Codex のドキュメントの Pricing ページにある速度モードの倍率表と、Speed ページの対象プランの記述だ。提供開始の時点では Pro 500ドルに限られている入口が、ほかのプランへ広がるかどうかは、そこで最初に分かる。

ことば

  • トークン — AI が文章を読み書きするときに、文章を細かく区切って数える単位。API の料金も生成の速さもこの数で測られ、Ultrafast が速くするのも、このトークンを出す速さだ。
  • WebSocket — サーバーとの接続を張ったままにして、やり取りを続ける通信の方式。要求のたびに接続し直す方式より往復の手間が少なく、AI が道具を何度も呼ぶ作業で待ち時間を減らしやすい。
  • Codex — OpenAI のコーディング向けエージェント。ChatGPT のアカウントで使え、ChatGPT Work と料金・利用枠を共有している。今回の Ultrafast も、この二つで同じ条件が適用される。

あなたの作業のうち、画面の前で AI の返事を待っている時間は、どれくらいあるだろうか?

参照

あなたの暮らしで、最初に試せることは何でしょうか。