OpenAI、ChatGPTをより人間らしく会話させるフルデュプレックス音声アップグレード「GPT-Live」を発表
OpenAI launches GPT-Live, a full-duplex voice upgrade that lets ChatGPT talk more like a person
OpenAIは、ChatGPTの既存の高度音声モードを置き換える新しい音声モデル「GPT-Live」を発表しました。GPT-Liveは、人間のように同時に聞き取り、話すことができるフルデュプレックスアーキテクチャを採用しており、これにより、より自然で中断のない会話が可能になります。GPT-Live-1は有料ユーザー向けに、GPT-Live-1 miniは無料ユーザー向けに提供され、iOS、Android、ChatGPT.comで展開されます。また、APIへの展開も予定されています。この新モデルは、音声対話レイヤーと推論レイヤーを分離し、推論にはGPT-5.5などの最先端モデルを利用します。これにより、会話の流れを維持しながら、ウェブ検索や複雑なタスクを実行できるようになります。OpenAIは、GPT-Liveの音声モデルを9種類にリマスターし、なりすまし防止策を講じています。週に1億5000万人が利用するChatGPTの音声機能は、視覚的なカード表示や3段階の応答速度選択などの新機能も追加されました。競合他社もフルデュプレックスシステムを開発しており、音声対話はAI製品の標準機能となりつつあります。GPT-Liveは、音声インターフェースをAIの主要なインターフェースと位置づけるOpenAIの戦略の重要な一歩です。
- OpenAIがChatGPT向けにフルデュプレックス音声モデル「GPT-Live」を発表
- GPT-Live-1は有料ユーザー向け、GPT-Live-1 miniは無料ユーザー向けに提供
- 音声対話レイヤーと推論レイヤーを分離し、推論にはGPT-5.5などの最先端モデルを利用
- ChatGPTの音声機能は週に1億5000万人が利用
- iOS、Android、ChatGPT.comで展開予定、API展開も予定
OpenAIがChatGPTの音声対話をフルデュプレックスに進化させた「GPT-Live」は、AIの主要インターフェースがテキストから音声へと移行する転換点を示す。有料・無料の両層に展開し、週1.5億ユーザーという巨大な既存基盤に新機能を載せたことで、音声AI分野での競争優位を固める動きとして注目に値する。API提供によるエコシステム拡大も視野に入っており、AI音声市場の中期的な勝者を占う上で重要な発表である。