
OpenAIはChatGPTの音声モード向けに新しいGPT-Live-1モデルを導入し、会話中の割り込みを減らし、同時に音声入出力を処理できるようにしました。
リアルタイム翻訳や視覚的な情報表示など新機能も加わり、より自然な会話体験が実現します。
何が起きたか
OpenAIが新型音声モデル「GPT-Live-1」を発表しました。従来のターン制モデルから全二重通信モデルに切り替え、話者の発言中に割り込まず、同時に音声の入出力を処理できるようになりました。
なぜ重要か
音声AIが人間との会話をより自然に進められるようになります。リアルタイム翻訳や、天気・株価・スポーツの情報を画像で表示する機能が追加されたため、ユーザーの利便性が向上すると考えられます。
注目点
GPT-Live-1はiOS・Android・ウェブ上でGoプラン、Plusプラン、Proプランの有料ユーザーに提供されます。無料ユーザーにはより効率的な「GPT-Live-1 mini」がデフォルト設定されます。
OpenAIの音声モード刷新は、AIとの対話体験を人間どうしの会話に近づける狙いです。従来のターン制音声モデルが正確性と流暢性に課題を抱えていたのに対し、全二重通信による同時入出力処理により、これらの問題を根本的に解決しようとしています。
リアルタイム翻訳や、天気・株価・スポーツ情報の視覚的補完といった新機能は、音声だけでなく複数チャネルでの情報提供を実現するもので、ユーザーの利便性を高める設計と言えます。また、OpenAIは自傷や危機的状況に対する安全措置やティーン向けの年齢適切な応答設計を導入しており、ユーザーの安全性確保に配慮した形となっています。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
DIGITIMESによると、AIシステムのスケール拡大に伴い、データセンター内の相互接続要件がチップやボードからラック、クラスター、さらにはデータセンター間リンクにまで拡大している

中国の大規模言語モデル開発企業Z.aiは、国産AIチップ約10万基を用いた大規模推論をサポートできると発表した

アナリストのミンチー・クオ氏によると、Nvidiaは大幅に再設計されたアーキテクチャを備えたAIアクセラレータ「Rubin CPX」を復活させ、生産は2027年第1四半期に開始される見込み

パランティア・テクノロジーズ株は長期上昇を続け、3年で11倍のリターンを達成

AppleはOpenAIとの法廷闘争を激化させ、新たな裁判所提出書類でOpenAIが証拠を積極的に隠滅していると主張

サムスン電子は、AIインフラ向け高帯域幅メモリ(HBM)の需要が衰えない中、メモリ生産能力の最大70%を長期供給契約(LTA)で固定した
