AIToday
音声・スピーチVercel AI Blog掲載日時: 2026年6月30日 1:002分で読める

Vercel、AI Gatewayで音声通話機能を提供開始

LINEで送る

要点

  • VerizelのAI Gatewayが音声・リアルタイム通話機能をベータ版で提供開始しました。

  • OpenAIとxAIのモデルに対応し、開発者は既存のテキスト・画像機能と同じ方法で音声通話、音声合成、音声認識をアプリケーションに統合できます。

  • 従来のように複数モデルを組み合わせる必要がなく、より自然な対話が実現する点が特徴です。

3つのポイント

  1. 何が起きたか

    Vercelの開発者向けプラットフォーム「AI Gateway」が音声・リアルタイム通話機能をベータ版で提供開始しました。OpenAIとxAIのモデルに対応し、テキストや画像と同じ方法で音声通話、音声合成、音声認識を利用できます。

  2. なぜ重要か

    これまでは音声認識→言語処理→音声合成という複数モデルのチェーンが必要でしたが、単一の音声モデルが直接音声を入出力するため、より自然な対話が実現します。音声アシスタントやカスタマーサポートなど、ユーザーが話しかける方が自然なアプリケーションを開発しやすくなります。

  3. 注目点

    ベータ版はAI SDK 7で利用可能です。既存のAI Gatewayユーザーは同じAPI認証情報や支出管理機能を使いながら、新たに音声機能を追加できます。

この記事についてAIに質問する →

よくある質問

どのモデルが対応していますか?
OpenAIとxAIのモデルに対応しています。具体的にはOpenAIのgpt-realtime-2やxAIのgrok-ttsが利用可能です。
リアルタイム音声通話と従来の方法の違いは何ですか?
リアルタイム音声モデルは音声を直接入出力するため、単一のモデルで完結します。一方、従来は音声認識→言語モデル→音声合成という3段階のパイプラインが必要でしたが、この新方式ではそれが不要になります。
いつから利用できますか?
ベータ版はAI SDK 7で利用可能です。また、Vercelのプレイグラウンドでコードを書かずにブラウザ上で試すこともできます。
Vercel AI Blog元記事を読む

「音声・スピーチ」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へNVIDIAロボット自動改善システム、99%成功率達成 Tencent大規模GPU運用公開