OpenAIが新音声モデル「GPT-Live」を発表
2026年7月8日、OpenAIは新世代の音声モデル「GPT-Live」を発表し、ChatGPTの音声対話機能「ChatGPT Voice」を同時にアップデートしました。この新しいモデルは、ユーザーとの対話をより自然に行うための機能を強化しています。
GPT-Liveの特徴
フルデュプレックスアーキテクチャ
GPT-Liveは「全二重(フルデュプレックス)アーキテクチャ」を採用しており、これによりモデルは入力(聞き取り)を処理しながら同時に出力(発話)を生成できます。具体的には、ユーザーが話している間に相づちを打ったり、考えている間は待機したり、必要に応じて割り込むといった判断を1秒間に何度も行うことが可能です。この機能により、よりスムーズでインタラクティブな会話が実現します。
バージョンの提供
OpenAIはGPT-Liveの2つのバージョン「GPT-Live-1」と「GPT-Live-1 mini」を、iOS、Android、およびChatGPT.com(Web版)のChatGPTユーザーに対してグローバルにロールアウトを開始しました。有料プラン(Go、Plus、Pro)のユーザーには「GPT-Live-1」が、無料プラン(Free)のユーザーには軽量版「GPT-Live-1 mini」が、ChatGPT Voiceのデフォルトモデルとして順次提供されるようになっています。
旧バージョンとの違い
リリース当初、GPT-LiveはChatGPTにおける「音声+動画」や「音声+画面共有」の同時利用をサポートしていません。これらの機能が必要な場合は、旧バージョンのChatGPT Voice(Legacy Voice)を使用する必要があります。この点は、ユーザーにとって重要な選択肢となるでしょう。
API提供の予定
OpenAIは、GPT-LiveのAPI提供を今後数週間以内に予定しており、開発者や企業ユーザーは事前に登録して通知を受け取ることができます。これにより、さまざまなアプリケーションでGPT-Liveの機能を活用することが期待されます。
まとめ
OpenAIの新しい音声モデル「GPT-Live」は、より自然な対話を実現するための重要なステップです。特に、フルデュプレックスアーキテクチャにより、ユーザーとのインタラクションが一層スムーズになります。今後のAPI提供により、開発者たちがこの技術をどのように活用するのか、非常に楽しみです。