OpenAI が米国時間 9 月 23 日、ChatGPT の音声からメール・カレンダー・Slack といった接続済みのアプリを使えるようにした。同じ告知で、音声は ChatGPT Work にも入り、話しかけるだけで文書や表を作れると説明している。
広がったのは頼める範囲だ。ただし実行の承認までが声に移ったわけではない。何をどこまで声で預けられるのかは、告知の三行からは読み取れない。
告知に書かれた三つ
OpenAI の投稿は、ChatGPT Voice にできるようになったことを三つ挙げている。メール・カレンダー・Slack のようなプラグイン、つまり一度繋いでおいた外部サービスを使えること。GPT-6 Astra・Sol・Luna で動くこと。そして web とモバイルの ChatGPT Work で使えるようになり、文書・スライド・サイト・表計算を作ったり、ブラウザ上の込み入った作業を話すだけで進められること。末尾に、本日より最新版のアプリで全世界に順次提供する、と書かれている。
範囲を一番広げるのは一つ目だ。これまでの音声は、聞いて答える相手だった。接続済みのアプリが入ると、受信箱や予定表の中身を見に行く相手になる。
声で頼めて、声では決められない
Unite.AI の説明によれば、承認が要る操作にあたったとき、音声の会話中に画面上の確認が出て、そこで承認か拒否を選ぶ。声で承認することには対応していない、と OpenAI が述べているという。既存のアプリ権限と職場側の制限は、そのまま効く。
OpenAI の投稿そのものは、権限の扱いに触れていない。三行はできるようになったことだけを並べており、どの操作で確認が挟まるのか、どこまでが確認なしに進むのかは書かれていない。
ここに実践上の段差がある。音声が向くのは、手や目が別のことに使われている時間だ。運転中、調理中、歩いている間。承認が画面に残るなら、その時間に完結する作業と、途中で画面を見る必要がある作業は分かれる。メールを読み上げさせるのと、返信を送らせるのは、同じ会話の中でも性質が違う。
完結しない条件を先に知っておく
Unite.AI の整理では、音声の Live に映像や画面共有はまだなく、ChatGPT のライブラリにあるファイルを自分で探して持ってくることもできない。手動でチャットに添付すれば読める。
使える時間の上限もプランで違う。無料は会話を担う軽い側のモデル GPT-Live-1 mini に限られ、Go が mini で 3 時間まで、Plus が GPT-Live-1 で 3 時間まで、月 100 ドルの Pro が 15 時間まで、月 200 ドルの Pro が無制限、と説明されている。音声から始めた Work の作業は、打ち込んで始めた作業と同じように通常の利用分を消費する。
モデルの割り当ても、告知の文面だけでは決まらない。OpenAI は GPT-6 の三モデルで動くと書いているが、Unite.AI は Live が GPT-Live-1 か mini で動き、検索や難しい問いのときに GPT-5.6 や GPT-6 Astra を呼ぶ、と説明している。どちらの記述も、どの発話がどのモデルに渡るかまでは書いていない。
確かめる先は手元にある。アプリが最新版に上がった日に、設定の接続済みアプリの権限欄を開いて、どのアプリが読み取りまでで、どれが送信まで許可されているかを見ておく。既定の権限や確認の挟まり方が公式に書かれるとしたら、OpenAI のリリースノートの側だ。順次提供と告知にある以上、手元に届く時期は一律ではない。
ことば
- 接続済みアプリ — ChatGPT を外のサービスに繋ぐ仕組み。一度サインインしておけば、以後は会話の中からメールや予定表の中身を参照できる。今回、この経路が音声の会話にも開いた。
- ChatGPT Work — 文書や表計算を作り、ブラウザ上で手順のある作業を進める層。今回から音声で指示を出せるようになり、そこで動かした作業は通常の利用分を消費する。
- GPT-Live-1 — 音声の会話そのものを担うモデル。プランによって上位版と mini に分かれ、ひと月に使える時間の上限もそこで変わる。
画面を見ずに済ませたかった作業のうち、承認のために手を止めてよいのはどれだろうか?