Googleは、音声で会話するAIモデル「Gemini 3.8 Live」に、話す映像のアバターを組み合わせる「Live Avatar」を発表しました。企業が作る問い合わせ窓口や操作案内のAIに、口の動きや表情のある「案内役」を付けられるようになります。
この記事は、Googleが2026年9月24日に公開した公式発表をもとに、2026年9月26日時点の情報で書いています。
何が発表されたか
Live Avatarは、音声対話と低遅延の映像生成を組み合わせた機能です。AIが話を聞き、見て、アバターの映像つきで話し返します。主な要点は次のとおりです。
- 映像の案内役: 話す内容に合わせた口の動き(リップシンク)や自然な表情、なめらかな会話の受け渡しを備えます。公式は、顧客対応や対話形式の操作案内(ウォークスルー)での利用を例に挙げています
- 音声と映像を同時に理解: 相手の声と映像の入力を同時に処理します。Google Cloudのブログでは、カメラ映像や画面共有を音声と一緒に扱えると説明しています
- 会話を止めずに裏で処理: 非同期のツール呼び出し(外部のシステムやデータを呼び出す仕組み)で、会話を続けながら裏でデータを取得できます。公式はホテルのチェックイン対応を例に示しています
- 97言語に対応: 会話の途中で言語を切り替えても、口の動きや表情が合わせて変わるとしています
- アバターの選択と作成: 用意された複数のアバターから選べます。参照画像から独自のアバターを作る機能は、現在は企業ごとの許可リスト(allowlist)経由のみです
- 透かし(SynthID): 生成された音声と映像には、目に見えない電子透かし「SynthID」が埋め込まれます
提供範囲は次の表のとおりです。
| 項目 | 公式情報 |
|---|---|
| 提供開始 | 2026年9月24日の発表時点で「本日から」提供 |
| 提供先 | Gemini Enterprise(API経由で開発者が組み込む) |
| 提供状況 | Google Cloudのブログでは一般提供(GA)と案内 |
| エンドポイント | 米国とEUのエンドポイントで提供(Google Cloudのブログ) |
| 料金 | 発表本文には記載なし(Google Cloudの料金ページを案内) |
| 日本語対応 | 「97言語」とされていますが、日本語が含まれるかは明記されていません |
日本の企業・学校でどう使えるか
ここからは、公式発表をもとにしたTERRAISEの考えです。Live Avatarは、Geminiアプリにそのまま付く機能ではありません。企業が自社のサービスや窓口に組み込む、開発者向けの部品と考えるのがよさそうです。
業務・授業での使いどころ
1. Webサイトや店舗端末の問い合わせ窓口(カスタマーサポート部門) - 入力: お客様の音声での質問 - 処理: 予約や在庫のシステムをツール呼び出しで参照 - 出力: アバターが映像と音声で回答し、必要なら担当者へ引き継ぐ
公式のホテルのチェックイン例に近い使い方です。まずは営業時間外の一次対応から始めることが考えられます。
2. 社内システムの操作案内(情報システム部門・人事部門) - 入力: 新入社員の質問と画面共有 - 処理: 画面の状態を見て、操作手順を判断 - 出力: アバターが次に押す場所や手順を話して案内
マニュアルを読むより質問しながら進めたい場面に向きます。
3. 多言語での案内(観光・小売・学校の国際交流) - 入力: 外国語での質問 - 処理: 言語を判別し、同じ言語で応答 - 出力: 相手の言語で話すアバターの映像
学校なら、留学生や海外の保護者向けの学校案内が考えられます。語学の会話練習の相手としての試作も考えられます。ただし、どちらも開発が必要です。
始め方
一般的な進め方として、次の順番がおすすめです。
- DX担当・情報システム担当が、自社でGoogle Cloudの「Gemini Enterprise」を使える契約や環境があるかを確認します
- 用途を1つに絞り、その業務を入力 → 処理 → 出力に分けて書き出します。AIに任せる工程と、人が担う工程をはっきりさせます
- 開発担当が公式のAPIドキュメントを読み、用意されたアバターで小さな試作を作ります
- 試作で、日本語の応答の質、遅延、1回あたりの費用を確かめます。料金はGoogle Cloudの料金ページで確認します
- 自社キャラクターなど独自のアバターが必要な場合は、許可リストの手続きについてGoogle Cloudに問い合わせます
注意点
- 入力されるデータ: カメラ映像や画面共有には、顔や個人情報、社外秘の画面が映ることがあります。何を映してよいかを社内ルールで決めてから使うのが安全です。学校では、生徒の映像を扱うかどうかを特に慎重に判断する必要があります
- データの置き場所: 公式に示されているのは米国とEUのエンドポイントです。日本国内での処理については、確認日時点で公表されていません
- 日本語対応: 「97言語」とされていますが、日本語が含まれるかは公式ページに明記されていません。本番導入の前に、必ず日本語で試験することをおすすめします
- 料金: 発表本文に料金の記載はありません。映像つきの対話は利用量が増えやすいため、試作の段階で費用を見積もるのがおすすめです
- 独自アバター: 参照画像からの作成は、現在は許可リスト経由のみです。実在の人物をもとにする場合は、本人の同意や肖像の扱いを事前に整理する必要があります
- AIであることの明示: 出力にはSynthIDの透かしが入ります。それとは別に、利用者に「AIが対応している」と画面で分かるようにしておくと、誤解を防げます
TERRAISEに相談する
Live Avatarを問い合わせ窓口や学校案内にどう当てはめるかは、業務を入力・処理・出力に分けると整理しやすくなります。60分の無料相談で、どの工程から試すかを一緒に整理できます。学校での活用は教育機関向けAI教育、全社のAI方針づくりはAI顧問のページもご覧ください。
出典(2026年9月26日 19:18 確認)
- Google「Introducing Gemini 3.8 Live with Live Avatar」
- Google「Gemini 3.8 Live with Live Avatarの一般提供開始(Google Cloudブログ)」
製品名・機能・提供範囲・料金は変わることがあります。導入前に必ず公式情報をご確認ください。
