AIToday
大規模言語モデル音声・スピーチAI Watch (Impress)掲載日時: 2026年9月28日 19:01

Google、Gemini 3.8 LiveにLive Avatar機能を追加

LINEで送る
Google、Gemini 3.8 LiveにLive Avatar機能を追加

3つのポイント

  1. 何が起きたか

    Googleは対話型音声モデルGemini 3.8 LiveにLive Avatar機能を搭載し、Gemini Enterpriseで利用可能になったと発表した。

  2. なぜ重要か

    Live Avatarは低遅延のストリーミング映像と対話を組み合わせ、顧客対応などのやり取りを対面会話に近い形にできるとGoogleは説明する。

  3. 注目点

    97言語で正確なリップシンク、自然な表情、動的な多言語同期を実現するとGoogleは主張しており、実際のサポート現場で視覚的な整合性が保てるかが試される。

誰に効くか企業向けのチャットや音声対応を運用するカスタマーサポートなどの顧客対応チームが最も想定された利用者だ。Googleはこうしたデジタル交流をより現実的にする用途としてこの機能を打ち出している。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Googleの発表は、同社がすでに個別に提供している2つの要素を組み合わせたものだ。対話型音声モデルと低遅延ストリーミング映像である。その上にアバターを載せることで、Googleはこのやり取りを対面会話に近いものとして提示している。ユーザーは音声を聞くだけでなく、見て、話すことができる。

同社はこの機能を主に顧客対応の場面に位置づけている。カスタマーサポートやインタラクティブな操作案内を、アバターによってより現実感のあるデジタル交流にすることを想定しているとし、正確なリップシンク、自然な表情、円滑なやり取りをその効果を支える特長として挙げている。

多言語の部分で主張はより具体的になる。Googleはリップシンクと表情を動的に調整することで、97言語の切り替えが視覚的なずれなく行われるとしている。したがって企業の導入検討者にとっての焦点は、アバターを表示できるかどうかよりも、実際のサービス会話でその整合性と表現力が保たれるかどうかにかかっている。顧客が見ているものへの信頼が問われる場面だからだ。

よくある質問
Gemini 3.8 Live with Live Avatarはどこで使えるか?
Googleによれば、すでにGemini Enterpriseで利用可能だという。
Live Avatarは何言語に対応するか?
Googleによれば、多言語音声同期機能により、リップシンクと表情を動的に調整し、視覚的なずれなく97言語をシームレスに切り替えられるという。
どのようなアバターを表示できるか?
記事によれば、アニメ風キャラクターからリアルな人物、動物をモチーフにしたキャラクターまで幅広い。
AI Watch (Impress)元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Adobe、GeminiとClaudeに制作ツール連携ITmedia AI+ · 4時間前
  • Jev Bookmarks公開、Chrome履歴から開始ページ選定Zenn AI/ML · 7時間前
  • Claude Fable 5、公開3日で米政府が停止Simon Willison's Weblog · 10時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へ401(k)が失業招くAIに資金提供