OpenAIが「GPT-Live-1」を発表
2026年9月10日、OpenAIは新しい音声エージェント「GPT-Live-1」をAPIで公開しました。この新しい技術は、開発者が自然なフルデュプレックス音声会話を実現するための強力なツールとなります。
フルデュプレックス音声会話とは?
フルデュプレックス(full-duplex)とは、同時に双方向のコミュニケーションが可能な技術を指します。つまり、話し手と聞き手が同時に会話を行えるため、より自然でスムーズな対話が実現します。GPT-Live-1はこのフルデュプレックス機能を搭載しており、ユーザーはより直感的にAIと会話を楽しむことができます。
主な機能
OpenAIは、GPT-Live-1が以下のような機能を持つことを発表しました:
- 同時に聞き取りと発話が可能:ユーザーが話している間にAIも応答を生成することができます。
- 割り込み処理:会話の流れを途切れさせることなく、必要に応じてAIが応答を挿入できます。
- バックエンドのモデルやツールへの委任:AIは、より複雑な処理や推論を他のモデルやツールに委任することができ、効率的な会話を実現します。
利用料金と用途
GPT-Live-1はAPIを通じて利用可能で、フロントエンドの音声レイヤーの料金は1分あたり0.05ドルと設定されています。この価格設定は、開発者が手軽に導入できるよう配慮されています。
また、OpenAIはこの技術の用途として、電話での利用や顧客対応など、さまざまなフルデュプレックス音声エージェントのシナリオを挙げています。これにより、企業は顧客とのコミュニケーションをより効率的に行うことが可能になります。
ChatGPT Voiceとの連携
さらに、OpenAIのヘルプセンターによると、ChatGPT Voiceは有料ユーザー向けにGPT-Live-1を、無料ユーザー向けには「GPT-Live-1 mini」を提供することが記載されています。これにより、より多くのユーザーが新しい音声エージェントの機能を体験できるようになります。
まとめ
OpenAIの「GPT-Live-1」は、フルデュプレックス音声会話を実現するための革新的な技術です。これにより、AIとの対話がより自然でスムーズになることが期待されます。企業や開発者にとって、この新しいツールは顧客対応やコミュニケーションの質を向上させる大きなチャンスとなるでしょう。