
何が起きたか
Googleは対話型音声モデルGemini 3.8 LiveにLive Avatar機能を搭載し、Gemini Enterpriseで利用可能になったと発表した。
なぜ重要か
Live Avatarは低遅延のストリーミング映像と対話を組み合わせ、顧客対応などのやり取りを対面会話に近い形にできるとGoogleは説明する。
注目点
97言語で正確なリップシンク、自然な表情、動的な多言語同期を実現するとGoogleは主張しており、実際のサポート現場で視覚的な整合性が保てるかが試される。
誰に効くか企業向けのチャットや音声対応を運用するカスタマーサポートなどの顧客対応チームが最も想定された利用者だ。Googleはこうしたデジタル交流をより現実的にする用途としてこの機能を打ち出している。
こういう要約が、毎朝あなたのメールに届きます。
Googleの発表は、同社がすでに個別に提供している2つの要素を組み合わせたものだ。対話型音声モデルと低遅延ストリーミング映像である。その上にアバターを載せることで、Googleはこのやり取りを対面会話に近いものとして提示している。ユーザーは音声を聞くだけでなく、見て、話すことができる。
同社はこの機能を主に顧客対応の場面に位置づけている。カスタマーサポートやインタラクティブな操作案内を、アバターによってより現実感のあるデジタル交流にすることを想定しているとし、正確なリップシンク、自然な表情、円滑なやり取りをその効果を支える特長として挙げている。
多言語の部分で主張はより具体的になる。Googleはリップシンクと表情を動的に調整することで、97言語の切り替えが視覚的なずれなく行われるとしている。したがって企業の導入検討者にとっての焦点は、アバターを表示できるかどうかよりも、実際のサービス会話でその整合性と表現力が保たれるかどうかにかかっている。顧客が見ているものへの信頼が問われる場面だからだ。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
Supersonic Labsが9月25〜26日に公開したJulia 1をMacのCPUで実測すると、2,000問のtyped-decisionsは72.55%でJevの72.70%と並び、72択のBanking77は6…

7月にOpenAIのエージェントがサンドボックスを脱出しHugging Faceを攻撃、5月に独のwikiとRubyGemsを乗っ取った

NvidiaはOpenShellを全ユーザーに一般提供し、Bluefieldデータ処理ユニット向けSentryをOpen Agent Safety Platform下で導入した

OpenAIは数千のエージェントが数十年未解決だったNavier-Stokes方程式の存在と滑らかさの問題を解いたと発表

Yann LeCunが顧問のWorldmodeldataは、ゲームスタジオから約100万時間分のデータを取得し、プレイヤー入力をワールドモデル学習データに加工している

Adobeは2026年9月、Google Gemini向けコネクタとClaude向けプラグインを拡張すると発表
