Google、Geminiに対話アバター機能を追加 97言語のリップシンクに対応
- Geminiに対話しながら映像を生成するアバター機能が加わりました。
- 2026年9月24日からAPI経由で提供が始まっています。
- 法人向けプランの「Gemini Enterprise」利用者が対象です。

Google DeepMindは2026年9月24日、AIモデル「Gemini 3.8 Live with Live Avatar」を発表しました。音声での対話に合わせて、画面上のアバターが表情や口の動きをリアルタイムに動かします。
本機能は97言語に対応しており、会話の途中で言語が切り替わっても口の動きを正確に合わせます。また、アバターとの対話を続けながら、背景でデータの取得や予約手続きなどの外部処理を同時に実行できます。
生成されたすべての映像と音声には、AI生成物であることを識別できる電子透かし技術「SynthID」が直接埋め込まれます。
法人の担当者は、ホテルのチェックイン案内や自社サービスの解説といった対面に近い接客を、画面越しに自動で提供できるようになります。
ひらたく言うと、AIが画面越しに顔を出して、こちらの話を聞きながら身振り手振りと表情つきで接客してくれる機能です。たとえるなら、タブレット端末の中に常駐してくれるホテルの受付窓口のような仕組みです。裏で手続きの処理を進めながらも会話が止まらないため、無言の待ち時間を作らずに自然な案内を任せられます。

筆者が気になったのは、単に顔が動くだけでなく、裏で外部ツールの呼び出しをしながら会話を止めない点です。画面の向こうでAIが沈黙してしまう不自然さが、かなり解消されそうです。
待ち時間ゼロの接客へ。
ただ、独自アバターの作成は現在ホワイトリスト制の限定提供にとどまります。まずは秋の法人利用で、97言語のリアルタイム切り替えがどこまで滑らかに動くかを確かめたいところです。
オンラインで顧客対応や窓口案内を行っている人は、AIアバターを使って対話を途切れさせずに手続き案内を代行できるようになります。

