OpenAI、全二重音声モデル「GPT-Live」を発表
AI要約 ITmedia AI+ 元記事を読む
OpenAIは、新しいリアルタイム音声モデル「GPT-Live」を発表しました。このモデルは全二重方式を採用しており、ユーザーが話している最中でもAIが聞き取り、応答することが可能です。これにより、ChatGPTの音声機能が刷新され、より人間らしいスムーズな会話体験が実現します。
なぜ重要か
従来の音声AIは、人間との自然な対話が難しいという課題がありました。GPT-Liveの全二重方式は、相づちや割り込みを可能にすることで、会話の流暢さとリアルタイム性を飛躍的に向上させます。これにより、音声アシスタントや対話型AIのユーザー体験が大きく変革されると期待されます。
背景
OpenAIはこれまでもChatGPTに音声対話機能を提供してきましたが、応答にタイムラグがあるなど、改善の余地がありました。AI技術の進化に伴い、より人間らしい自然な音声コミュニケーションへのニーズが高まっています。今回の発表は、そうした課題に応え、音声AIの対話品質を一段と引き上げるものです。
今後の注目点
GPT-Liveが有料・無料の各プランに順次展開されることで、実際の利用体験がどう変化するかが注目されます。この技術が、今後の音声AI市場や他社の開発競争にどのような影響を与えるかにも要注目です。
原題: OpenAI、リアルタイム音声モデル「GPT-Live」公開 相づちも割り込みも、より人間らしい会話に