Gemini 3.8 Live に口元同期する映像アバターを組み合わせた「Live Avatar」を、Googleが2026年9月24日に発表し、企業向けのGemini Enterpriseで一般提供を開始しました。
📖 この記事で分かること
- Gemini 3.8 Live with Live Avatarで何ができるか
- 企業向けの提供範囲と対応地域
- カスタムアバターの作り方と審査の条件
- 導入を検討するときの判断ポイント
💡 知っておきたい用語
- Live Avatar:AIの音声に合わせて口や表情が動く「画面の中の案内係」。受付の人が画面越しに話してくれるイメージです
最終更新日: 2026年9月25日
▶ 公式ページ
- Introducing Gemini 3.8 Live with Live Avatar(Google 公式ブログ)
- Gemini 3.8 Live with Live Avatar is now generally available(Google Cloud Blog)

Gemini 3.8 Live with Live Avatarとは
この記事のポイント
- Googleが2026年9月24日、Gemini 3.8 Live with Live Avatar(2026年9月時点)を発表しました。
- 音声対話AIに口元同期する映像アバターを組み合わせ、97言語に対応します。
- Gemini Enterpriseで一般提供(GA)。US・EUエンドポイントで使えます(2026年9月時点)。
Gemini 3.8 Live with Live Avatarは、音声で会話するAIに「顔」を与える機能です。Googleは2026年9月24日に公式ブログで発表し、Google Cloud Blogでは企業向けの一般提供(GA)開始を告知しました。Google Cloud Next 2026でプレビューされていたものが、正式に使える段階に入った形です。
土台になっているのは、9月16日に公開された音声対話モデルのGemini 3.8 Liveです。今回はその上に、リアルタイムで生成される映像アバターが乗りました。AIが話す声に合わせて口元が動き、表情が変わり、相手の話に割り込まれても自然に受け答えを続けます。Googleはこれを「ほぼリアルタイムの視覚的な存在感」と説明しています。
何ができるのか:5つの機能
結論から言うと、「話す・聞く・見る・調べる」を1つのアバターが同時にこなせる点が中心です。公式に挙げられている機能は次の5つです。
- 口元同期付きの映像アバター: 音声と唇の動きを合わせた映像をリアルタイムに生成します
- 音声対音声の自然な対話: 文字起こしを挟まない音声対話で、途中で割り込まれても会話を立て直します
- 非同期ツール呼び出し: 会話を止めずに、裏でAPIや顧客管理システム(CRM)、基幹システム(ERP)などを呼び出せます
- 97言語の自動切り替え: 話している言語を自動で検出し、口元や表情もその言語に合わせます
- カメラ映像・画面共有の理解: 利用者のカメラ映像や画面共有を、音声と同時に理解します
非同期ツール呼び出しは、接客用途では地味に効く機能です。「在庫を確認しますので少々お待ちください」と沈黙する時間を減らし、話を続けながら裏で照会を進められます。
提供範囲とアバターの作り方
提供先はGemini Enterpriseで、一般消費者向けのGeminiアプリへの提供は今回の発表には含まれていません。US・EUのエンドポイントが用意され、プロビジョンドスループット(処理能力の事前確保)、企業向けのコンプライアンス、厳格なデータガバナンスに対応するとしています。Google Cloudコンソールのスタジオ画面とLive APIから利用でき、料金はGoogle Cloudの料金ページに掲載されています。
アバターは2通りの用意の仕方があります。
- 既製アバターから選ぶ: Googleが用意した多様なアバターのライブラリから選んで、そのまま配備できます
- カスタムアバターを作る: 参照写真1枚、音声サンプル、システム指示から、ブランドに合わせたアバターを作れます
ただしカスタムアバターは誰でも作れるわけではありません。企業ごとの許可リスト登録と厳格な審査が必要で、Google Cloudの営業担当を通じて申請する仕組みです。生成される音声と映像にはすべて、目に見えない電子透かしのSynthIDが埋め込まれます。
なお、関連モデルのGemini 3.8 Live Extended Thinkingはプライベートプレビューのままです。
想定される使い道
Googleが想定しているのは、Web・モバイル・店頭キオスクでの接客や案内、サポート窓口です。Google Cloud Blogでは、Gemini Liveの活用例としてCox Automotive(Autotrader)の車探し支援や、SalesforceのAgentforceとの連携が紹介されています。これらがLive Avatarそのものの導入事例かどうかは明記されていないため、「音声エージェントの延長線上にある用途」と読むのが妥当です。
具体的には次のような場面が考えられます。
- 多言語対応が必要な施設の受付・案内
- 商品比較や手続きを画面共有しながら説明するオンライン接客
- 保険や各種申請など、途中でシステム照会が挟まる問い合わせ対応
編集部の見方
「声だけ」と「顔あり」の差: 音声エージェントはすでに実用段階ですが、対面に近い安心感が求められる接客では、顔があるかどうかで受け止め方が変わります。今回の発表は、既存の音声対話にそのまま映像を足せる点に価値があります。
なりすまし対策を先に固めた設計: カスタムアバターを許可制にし、全出力にSynthIDを入れたことは、実在人物の顔を使った悪用を強く意識した判断です。自社の社員やタレントをアバター化したい企業にとっては手続きの手間になりますが、ブランドを守る側から見れば歓迎できる制約です。
向く組織・向かない組織: すでにGoogle Cloud上で問い合わせ対応や顧客管理システムを動かしている企業は、ツール呼び出しとの組み合わせで試しやすいはずです。一方、個人や小規模チームが気軽に試せる提供形態ではありません。まずは既製アバターで効果を測り、カスタムは効果が見えてから検討する順番が現実的です。
確認すべき点: 料金の水準と、日本語での口元同期の自然さは導入前に自社で確かめる必要があります。映像生成を伴うぶん、音声のみの場合と費用が変わる可能性があるため、料金ページで条件を確認してから試算するのが安全です。
よくある質問
Q: 普段使っているGeminiアプリでもアバターと話せますか?
A: 今回の発表はGemini Enterprise向けの一般提供で、一般消費者向けGeminiアプリでの提供は発表されていません。
Q: 日本語に対応していますか?
A: 97言語に対応し、言語を自動で検出して切り替えるとされています。言語ごとの一覧は公式ドキュメントで確認してください。
Q: 自社の社員の顔でアバターを作れますか?
A: 参照写真1枚と音声サンプルなどから作れますが、企業の許可リスト登録と審査が必要です。Google Cloudの営業担当への申請が前提になります。
まとめ
Googleは2026年9月24日、音声対話AIのGemini 3.8 Liveに映像アバターを組み合わせたLive Avatarを発表し、Gemini Enterpriseで一般提供を始めました。97言語の自動切り替え、会話を止めないツール呼び出し、SynthIDによる透かしを備え、接客や案内の窓口を想定した設計です。カスタムアバターは許可制のため、既製アバターで効果を測るところから始めるのが現実的です。
【用語解説】
- SynthID: Googleが開発した電子透かしの技術。AIが生成した音声や映像に、人には分からない印を埋め込み、後からAI生成物だと判別できるようにします
- GA【ジーエー】: General Availabilityの略。プレビュー段階を終え、正式に一般提供される状態を指します
- プロビジョンドスループット: 一定の処理能力をあらかじめ確保しておく契約形態。混雑時でも応答速度を保ちやすくなります
引用元:
- [1] Introducing Gemini 3.8 Live with Live Avatar(Google 公式ブログ)
- [2] Gemini 3.8 Live with Live Avatar is now generally available(Google Cloud Blog)
この記事について: AI 支援で執筆、編集部が事実確認・編集しています。誤りや追加情報があれば Contact よりお知らせください。
Previous Post
生成AIニュース 昨日【2026年9月24日(木)】のAI公式発表を3分でチェック
Next Post
ChatGPTに声で仕事を頼めるように。音声会話でプラグイン対応、Workもスマホで
15 年以上の開発経験を持つソフトウェアエンジニア / テクノロジーライター。AI エージェントの実務活用を研究し、現場や経営者向けセミナーでその知見を発信。本メディア tech-noisy.com では、一次情報に基づく最新ニュース・解説記事を執筆。また、音楽生成 AI による DJ パフォーマンスを企業イベントで行うなど、テクノロジーと表現の融合も探求している。