Gemini 3.8 Live with Live AvatarがGemini Enterpriseで一般提供開始
公開:
Google Cloudは、企業向けにGemini 3.8 Live with Live AvatarのGemini Enterpriseでの一般提供を開始しました。Live Avatar機能は、ウェブやモバイル、インタラクティブキオスクなどの会話型動画エージェントに、視覚的なインタラクションをもたらす機能です。[1]
この記事では、Gemini 3.8 Live with Live Avatarで使える機能や使い始める場所、提供地域などの利用条件を解説します。カスタムアバターのように提供範囲が限られる機能も、区別して説明します。[1][2]
目次
Gemini 3.8 Live with Live Avatarでできること
Gemini 3.8 Liveが流暢で応答性の高い会話を実現する土台は、ネイティブの音声間基盤です。Gemini 3.8 LiveとLive Avatar機能の主な機能は、以下の通りです。[1]
- リップシンクが同期された動画アバターの生成(カスタムアバターは許可リスト登録時のみ)
- 会話の文脈やバックエンドの処理を途切れさせない、ユーザーの割り込みへのより自然な対応
- 会話を続けながらのバックグラウンドでのツールとAPIの呼び出し
- 97の言語の理解と発話、言語の自動検出への対応
- ライブカメラのフィードや画面共有の、音声と同時のリアルタイム処理[1]
ツール呼び出しは、会話を続けながらバックグラウンドで実行されます。モデルはリクエストを認識したうえで、タスクが完了するまでユーザーとのチャットを続けられます。[1]
Live Avatar機能では、厳選された事前構築済みアバターのライブラリからアバターをデプロイできます。生成されたすべての音声ストリームと動画ストリームには、人間には感知できないSynthIDの透かしが埋め込まれています。[1]
Gemini 3.8 Live with Live Avatarの使い方
Gemini 3.8 Live with Live Avatarのモデルと機能を試す入口は、Gemini Enterpriseです。Google Cloudコンソールでは、Agent Platform > Studio > Stream realtimeページでライブアバターを構成できます。このページでは、gemini-3.8-liveへのモデル切り替えや「ライブ アバター」の選択、アバターと音声の指定を経てセッションを開始します。[1][2]
APIでは、generation_configで"response_modalities": ["VIDEO"]を設定します。あわせて、avatar_configでプリビルドアバターの名前を、speech_configで事前構築済みの音声を指定します。次のコードはGoogle Gen AI SDKの例で、LiveConnectConfigに同じ設定を渡してgemini-3.8-liveのライブセッションに接続します。[2]
from google import genai
from google.genai import types
client = genai.Client()
config = types.LiveConnectConfig(
response_modalities=["VIDEO"],
speech_config=types.SpeechConfig(
voice_config=types.VoiceConfig(
prebuilt_voice_config=types.PrebuiltVoiceConfig(
voice_name="Puck",
)
)
),
avatar_config=types.AvatarConfig(
avatar_name="Ben",
),
system_instruction=types.Content(
parts=[types.Part.from_text(text="You are a helpful customer service assistant.")]
),
)
async with client.aio.live.connect(model="gemini-3.8-live", config=config) as session:
# Interact with the live session...
pass
公式資料からの抜粋:ライブアバターを構成する(API を使用してライブ アバターを構成する / Python SDK の構成)。対象版・範囲:Gemini Enterprise Agent Platformドキュメント(取得時点、AI翻訳版)。[2]
上記のコードでは、avatar_nameにBen、voice_nameにPuckを指定し、モデルにはgemini-3.8-liveを使っています。ライブアバターが生成するのは、gemini-3.8-liveの合成音声応答と同期した、話すアバターのリアルタイム動画です。[2]
Gemini 3.8 Live with Live Avatarの提供条件
Gemini 3.8 Live with Live Avatarは、企業向けに提供が開始されています。米国とEUのエンドポイントで提供され、プロビジョンドスループットやエンタープライズコンプライアンス、厳格なデータガバナンスを備えています。[1]
ライブアバターが使うモデルのgemini-3.8-liveは、リリースステージがGAで、2026年9月24日にリリースされました。提供リージョンは、マルチリージョンのusとeuに加え、米国のus-central1です。[2][3]
モデルのgemini-3.8-liveは、使用オプションとしてプロビジョンドスループットとPay-as-you-goに対応しています。バッチ推論と固定割り当ては、サポート対象外です。プロビジョンドスループットの有効化やカスタマイズされたデプロイアーキテクチャは、Google Cloudの営業担当者に問い合わせます。[1][3]
カスタムアバターを利用できるのは一部の利用者のみで、作成には厳格なエンタープライズ許可リストへの登録と身元確認プロセスが必要です。許可リストへの登録はGoogle Cloudの営業担当者に、アクセス権のリクエストはGoogle Cloudアカウントチームに問い合わせます。顔や音声のサンプルの処理に必要な同意と権利を確保する責任は、利用者が負います。[1][2]
発表時点では、Gemini 3.8 Live Extended Thinkingは限定公開プレビュー版のままでした。取得時点のgemini-3.8-liveのモデル仕様では、思考がサポート対象外とされています。[1][3]
出典
- ^ Google Cloud. 「エージェントを強化: Gemini 3.8 Live with Live Avatar の一般提供を開始」. https://cloud.google.com/blog/ja/products/ai-machine-learning/gemini-3-8-live-with-live-avatar-is-now-generally-available, (参照 26-09-30).
- ^ Google Cloud. 「ライブアバターを構成する」. https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/live-api/configure-live-avatars?hl=ja, (参照 26-09-30).
- ^ Google Cloud. 「Gemini 3.8 Live」. https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/gemini/3-8-live?hl=ja, (参照 26-09-30).












