Google、話す「顔」を持つGemini 3.8 Live with Live Avatarを一般提供
GoogleGeminiアバター音声AI多言語
Googleが2026年9月24日、リップシンクする実写風アバターを伴う対話モデル「Gemini 3.8 Live with Live Avatar」を一般提供開始した。97言語でリップシンクが動的に追従し、Gemini Enterpriseから利用できる。SynthIDによる透かしも付与される。
何が発表されたか
- Googleが2026年9月24日、Gemini 3.8 Live with Live Avatarの一般提供を発表
- ライブ対話と低遅延のストリーミング映像を組み合わせ、リップシンク・表情・自然なターンテイキングを備えたアニメーションアバターをほぼリアルタイムで生成
- 97言語に対応し、言語に応じて口の動きが動的に切り替わる
- 音声と映像の入力を同時処理。バックグラウンドでのデータ取得に使う非同期ツール実行にも対応
- 提供はGemini Enterprise経由。開発者はAgent Platform Studioからアクセスする
- 生成物にはSynthIDによる電子透かしが付与される。カスタムアバターの作成は現時点でエンタープライズの許可制(allowlist)
実務への影響
Web制作の観点では「サイトに埋め込む接客AI」の絵が一段変わる。これまでのチャットUIやボイスボットに対し、映像つきアバターは滞在時間と理解度を稼げる一方、帯域・レイテンシ・アクセシビリティ(字幕、モーション軽減設定)の設計負荷が増える。
現実的な使いどころは、ECの商品説明・サイズ相談、不動産や保険のような説明コストが高い業種のランディングページ、多言語サイトのオンボーディングあたり。97言語対応は、日本語サイトの多言語展開で人を雇わずに接客面だけ先に広げる選択肢になる。
ただし提供がGemini Enterprise+許可制である以上、小規模案件にすぐ降りてくる機能ではない。当面は「競合が先に導入したときに何が起きるか」を把握しておく段階と見るのが妥当。
利用条件
Gemini Enterpriseの契約が前提。カスタムアバター作成は別途エンタープライズ向け許可制。価格は公式発表時点で未公開。
