会話を止めず、裏で仕事するAI――Gemini Live Avatarが本番へ

会話を止めず、裏で仕事するAI――Gemini Live Avatarが本番へ

記事
IT・テクノロジー
公開日:2026年9月26日 | 一次資料確認:Google/Google Cloud/Google DeepMind

画面の中のアバターが、こちらを見て、話を聞き、自然に返事をする。その会話を続けたまま、裏では予約確認や情報取得などのツール処理まで進める。Googleが企業向けに正式提供した「Gemini 3.8 Live with Live Avatar」は、動画生成というより、視覚を持つ会話型エージェントに近い新機能です。

先に境界:本記事は公式資料を整理したニュース解説です。筆者が実際に契約・導入して検証した体験談ではありません。

何が変わったのか

確認できた事実:Googleは2026年9月24日にLive Avatarを発表し、Google Cloudは翌25日にGemini Enterpriseで一般提供(GA)になったと明記しました。以前のデモ段階から、企業が本番用途で利用できる段階へ進んだことが今回の変更点です。

アバターは音声と映像を同時に処理し、表情と口の動きを合わせながら対話します。公式発表では97言語に対応し、会話の途中で言語が変わっても同期するとしています。
gemini_fig1.png
図1:Live Avatarの基本動作。会話を止めずにツール処理を並行させる点が特徴です。

「見た目が話す」だけではない

重要なのは、アバター表示だけではありません。公式資料では、対話を続けながらバックグラウンドでAPIやツールを呼び出せると説明しています。ホテルのチェックインや保険事故の受付のように、利用者と会話しつつ、裏側でルール確認や書類作成を進める例が示されています。

これは人間の作業を減らす可能性があります。一方で、会話が自然になるほど利用者は「処理まで正しく終わった」と感じやすくなります。発話の自然さと、外部システムでの実行成功は別のEvidenceで確認する必要があります。
gemini_fig2.png
図2:発表と利用可能を分離。独自アバターは許可制です。

使える場所と、まだ残る制限

現在はGemini Enterprise向けで、Google Cloudは米国・EUエンドポイントを案内しています。独自の参照画像や音声から作るカスタムアバターは、企業向けの許可リストと本人確認を通す方式です。Gemini 3.8 Live Extended Thinkingは、25日時点でプライベートプレビューのままです。

Google DeepMindのモデルカードでは、Live Avatarの連続対話は「数分」で、長時間連続の利用を想定したものではないこと、遅延やタイムアウト、基盤モデル由来の幻覚が起こり得ることも記載されています。
gemini_fig3.png
図3:期待できる機能と、導入前に確認すべき境界。

MORIの活動との接点

解説動画や案内役を「録画して再生する」方式から、視聴者とその場で会話し、必要な情報を取りに行く方式へ変えられる可能性があります。記事・動画・商品案内をつなぐ入口としては面白い進化です。

ただし、現状は企業向けであり、MORIがすぐ個人利用できると確認できたわけではありません。使うなら、①日本からの利用条件、②料金、③参照画像の権利、④ツール実行ログ、⑤失敗時に人へ戻す仕組みを確認してからです。

まとめ

9月24日発表、25日にGemini Enterpriseで一般提供。

映像・音声を同時に扱い、97言語で会話しながら裏でツールを実行。

独自アバターは許可制。米国・EUエンドポイント中心で、日本の個人利用は未確認。

自然な会話と処理成功は別物。外部ログと人の確認が重要。

出典

Google公式:Introducing Gemini 3.8 Live with Live Avatar(2026-09-24)

Google Cloud公式:一般提供のお知らせ(2026-09-25)

Google DeepMind:Gemini 3.8 Audio Model Card(2026-09-15)

#Gemini #AIエージェント #生成AI
サービス数40万件のスキルマーケット、あなたにぴったりのサービスを探す