OpenAI、新しい音声モデル「GPT-Live」を公開。ChatGPTの音声モードが会話らしく自然に

30秒でわかる

  • OpenAIが新音声モデル「GPT-Live ↗」を公開、ChatGPTの音声モードで順次使えるように
  • 聞くと話すを同時に行う仕組み(全二重)で、相づち・割り込み・少し待つ、が自然にできる
  • 難しい質問は裏でGPT-5.5に任せ、会話を止めずに検索や推論の結果を返す

何が変わった

OpenAIが、AIとの会話をより本物の会話に近づける新しい音声モデル GPT-Live ↗ を公開しました。従来の音声モードは「あなたが話し終える→AIが答える」という順番待ちで、間が空いたり不自然に割り込んだりしていました。GPT-Liveは聞くことと話すことを同時に行える仕組み(全二重)で、「うんうん」「はい」といった相づちを打ったり、途中で質問を差し込んだり、考える間は静かに待ったりできます。ざっくり言うと、電話で人と話しているときのテンポに近づいた、ということです。さらに、検索や深い推論が必要な質問は裏側で最新のAI(提供開始時点はGPT-5.5)に作業を任せ、会話を続けたまま結果を返します。標準版「GPT-Live-1」と軽量版「GPT-Live-1 mini」があり、世界中のChatGPT利用者へ順次展開され、API(外部アプリから呼び出す仕組み)でも近日提供予定です。9種類の音声もこのモデル向けに作り直されています。

誰に関係する

ChatGPTの音声機能を使う人(ハンズフリーの調べもの・語学練習・雑談など)に関係します。展開は順次のため、自分のアプリでいつ切り替わるかは環境により異なります。

公式情報

公式ブログ(OpenAI) ↗