HyperAIHyperAI

Command Palette

Search for a command to run...

OpenAI、双方向音声モデル「GPT-Live」公開

OpenAIは、会話型音声AIの新たな標準となるモデル「GPT-Live」シリーズ(GPT-Live-1、GPT-Live-1 mini)を本日、グローバルに公開した。ChatGPTの音声機能を大幅に刷新し、フルデュプレックスアーキテクチャを採用することで、従来の逐次処理型音声AIが抱えていた応答遅延や会話の硬直性を解消する。本モデルは聴取と発話を同時に行い、相槌や一時停止、適度な割り込みを自然なタイミングで処理可能。複雑な推論や検索が必要なタスクでは、バックグラウンドで最新フラグシップモデル(初期設定はGPT-5.5)に処理を委任しながら会話を維持する設計となっている。 本日よりiOS、Android、Web版へ段階的ロールアウトを開始。プラスおよびプロユーザーにはGPT-Live-1、フリーユーザーにはミニバージョンがデフォルト適用される。音声処理速度や推論深度を瞬答・中・高から選択可能で、会話中に天気や株価などのリッチなビジュアルカードを表示する機能も追加された。安全性面では、音声特有のリスクに特化した学習とリアルタイム出力制御を実装。自傷や依存、暴力などの危険な応答を検知した場合、安全なトーンへの誘導や会話終了、危機対応リソースの提示を行う。ティーンユーザー向けの保護機能や、実在人物の声の模倣防止措置も強化されている。なお、API公開や動画・スクリーン共有音声への対応は今後追加される予定で、旧来のStandardおよびAdvanced Voice Modeは引き続き提供される。

関連リンク

Unknown SourceUnknown Source
OpenAI、双方向音声モデル「GPT-Live」公開 | 人気の記事 | HyperAI超神経