9月24日、Google Cloudが「Gemini 3.8 Live with Live Avatar is now generally available」と題した記事を公開した。AIアバターが「動いて話す」だけでなく、なりすまし防止のウォーターマークを内蔵し、カスタムアバターの作成を事前審査制に限定するというエンタープライズ安全設計を正面に押し出した点が、今回のリリースの本質的な差別化ポイントだ。リアルタイム音声会話にリップシンク映像を組み合わせた会話型エージェントは、OpenAIのGPT-4o Realtime APIなど競合もひしめく領域だが、Googleはエンタープライズコンプライアンスと悪用防止の仕組みをGAの条件として組み込んだ格好だ。
エンタープライズ安全設計が先に来る:SynthIDとアローリスト制限
生成された音声・映像ストリームには、Google DeepMindが開発した**SynthID**による人間には知覚できないウォーターマークが全ストリームに埋め込まれる。SynthIDはAI生成コンテンツに不可視の識別情報を付与する技術で、コンテンツの出所を後から検証可能にする。テキスト・音声・画像・動画と対応メディアを広げてきた技術であり、今回はリアルタイム映像ストリームへの適用となる。
アバター悪用への対策は二重になっている。まず、カスタムアバターの作成はエンタープライズアローリスト(事前審査・許可リスト)経由のみに制限されている。アローリストとは、Googleが事前に申請内容を審査し、許可した組織のみが機能を利用できる仕組みで、無審査での任意人物アバター生成を防ぐ。ディープフェイクや特定人物へのなりすましといった悪用リスクを、利用開始の入口で遮断する設計だ。事前構築済みのキュレーション済みアバターライブラリからの選択は、アローリストなしで利用可能となっている。
Gemini 3.8 Live + Live AvatarがGA
Gemini 3.8 Live with Live Avatarが、Gemini Enterprise上で一般提供(GA)となった。2025年4月のGoogle Cloud Next 2026でプレビューが初公開されてから、エンタープライズ本番環境向けに正式リリースされた形だ。直前にはGemini 3.8 LiveおよびGemini 3.8 Live Extended Thinking(プライベートプレビュー)の発表があり、今回のLive AvatarのGAはその一連の展開に続くものとなる。
利用可能なエンドポイントはUSおよびEU。プロビジョンドスループット(特定の処理量を専有的に確保する帯域保証方式)、エンタープライズコンプライアンス、厳格なデータガバナンスを備えている。モデルの試用はGemini Enterprise Studioから、実装はLive APIから開始できる。
Live Avatarの核心:リップシンク付きの映像エージェント
最大の目玉は、リップシンク同期に対応したビデオアバター生成だ。Web、モバイル、インタラクティブキオスクといった幅広いチャネルで、会話型ビデオエージェントに視覚的な存在感を与える。顧客対応窓口、ヘルスケアの問診案内、小売の接客エージェントといった、対面コミュニケーションに近い体験が求められるユースケースへの応用が主な想定となる。
主な機能
音声・言語まわりの性能も注目に値する水準だ。
- ネイティブ音声-to-音声(Speech-to-Speech):テキスト変換を介さずに音声を直接処理するため、割り込み発話からの自然な回復が可能。バックエンドのトランザクションや会話コンテキストを失わない。
- 97言語対応・自動言語検出:Gemini 3.8 Liveは97言語を理解・発話でき、言語を自動検出する。グローバル展開を前提とした多言語対応が標準で組み込まれている点は、エンタープライズ採用の判断材料になりうる。
- ツール呼び出し(Tool Calling)のバックグラウンド実行:APIコールやツール実行を会話と並行してバックグラウンドで処理。モデルはリクエストを受理しつつ、処理完了を待たずに会話を継続できる。バックエンド連携が必要な業務フローでも会話の流れを途切れさせない設計だ。
- ライブ映像・画面共有の同時処理:ライブカメラフィードや画面共有を音声と同時に処理し、エージェントがユーザーの見ている内容をリアルタイムで把握できる。技術サポートや教育など、画面を共有しながら進める対話シナリオに適する。
Extended Thinkingはまだ非公開
なお、Gemini 3.8 Live Extended Thinking(より複雑な多ステップ推論に対応した拡張版)はプライベートプレビュー段階にとどまっており、一般提供には至っていない。複雑なタスク処理と自然な音声会話を組み合わせた次のステップとして注目される機能だが、現時点では限定アクセスの段階だ。
詳細はGemini 3.8 Live with Live Avatar is now generally availableを参照していただきたい。




