AIToday
大規模言語モデル音声・スピーチHacker News掲載日時: 2026年4月29日 1:001分で読める

PAVO-Bench:音声認識からLLMへの処理を含む5万ターンのデータセットと8万5千パラメータのルーターを公開

LINEで送る
PAVO-Bench:音声認識からLLMへの処理を含む5万ターンのデータセットと8万5千パラメータのルーターを公開

3つのポイント

  1. GitHub上で公開されたPAVO-Benchは、音声認識(ASR)からLLM(文章を理解・生成するAI)を経由してテキスト音声変換(TTS)に至る一連の処理を評価するためのベンチマークデータセット。

  2. 50Kボイスターンのデータセットと85K-paramルーター(異なる入力に最適な処理経路を振り分けるモデル)を含む。

  3. Hacker Newsで共有され、コミュニティからのフィードバック受付中(コメント欄で議論可能)。

この記事についてAIに質問する →

LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Nvidia、Rubin CPXチップを大幅再設計で復活Yahoo Finance AI · 3時間前
  • AI助言の79%が実行、幸福感は不変ITmedia AI+ · 6時間前
  • 企業にエージェント統治の欠落SiliconANGLE AI · 9時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へFIDO Alliance、Google、Mastercardが協力してAIエージェント(自分で判断して買い物を実行するAI)による無断購入を防ぐ取り組みを開始