コンテンツへスキップ

media AI活用の最前線

Gemini 3.8 Live Avatarとは|料金・条件【2026年9月】

Gemini 3.8 Live Avatarとは|料金・条件【2026年9月】

2026年9月29日時点の要点:Gemini 3.8 Live Avatar は、Google が2026年9月24日(米国時間)に発表した、音声で話す Gemini 3.8 Live に「表情と口の動きがそろった映像のアバター」を付ける機能です。提供先は企業向けの Gemini Enterprise(Google Cloud の Gemini Enterprise Agent Platform)と Live API で、同日から一般提供(GA)が始まりました。料金はアバター映像の出力が100万トークンあたり1.00ドル(約150円)で、公式の換算値(1秒あたり6,192トークン)から計算すると、アバターが話している1分あたり約0.37ドル(約56円)です。対応リージョンは us・eu のマルチリージョンと us-central1 で、個人向けの Gemini アプリや Google AI Pro・Ultra での提供は2026年9月29日時点で公式に記載がありません。

この記事の要点(2026年9月29日時点)

  • 9月24日に Google が「Gemini 3.8 Live with Live Avatar」を発表。Gemini Enterprise で同日から一般提供。Google Cloud Next 2026 で先行公開していた技術の正式版です
  • できることは、口の動きと表情がそろった映像での応答、会話を止めずに裏でツールを呼ぶ処理、会話の途中での言語の切り替え、用意されたアバターの選択と、許可された企業だけのカスタムアバター作成
  • 料金は映像出力が100万トークンあたり1.00ドル(約150円)。課金はアバターが話している間だけで、聞いている間は課金されないと公式に記載されています
  • 対応リージョンは us・eu と us-central1。日本のリージョンは2026年9月29日時点で公式の一覧に記載がありません
  • 生成した音声と映像には SynthID の電子透かしが入ります。人の顔を使うカスタムアバターは、顔と声の利用に必要な同意と権利を利用企業が確保する責任があります

対象読者:Gemini を業務で使っている情報システム部門、顧客窓口や店頭案内を担当する部門、社内研修の企画担当。読み終えたらできること:自社で試す価値があるか、試すなら誰が何を決めるかを、公式の条件と料金をもとに判断できます。

音声で話す Gemini 3.8 Live そのものの基本(2モデルの違い、音声の料金、Gemini アプリでの使い方)は、9月16日に公開した Gemini 3.8 Liveとは|裏でタスク実行する音声AIの料金と使い方 で解説しています。この記事はその続報で、9月24日に加わったアバターの部分だけを扱います。

Gemini 3.8 Live Avatarとは|9月24日に企業向けで一般提供

Google の発表ブログは、この機能を「Gemini の会話 AI にほぼリアルタイムの視覚的な存在感を加えるもの」と説明しています。Gemini 3.8 Live はもともと、声で話しかけると声で返す音声対話のモデルです。Live Avatar を有効にすると、返事の音声に合わせて、画面の中の人物やキャラクターが口を動かし、表情を変えながら話します。利用者の声とカメラの映像を同時に受け取り、それを踏まえて音声と映像で返す、という流れです。

Gemini 3.8 Live Avatarの流れ。利用者の声とカメラ映像をGemini 3.8 Liveが受け取り、音声の返事と24 FPSのアバターの映像を返す。企業のサイト・アプリ・店頭端末に組み込む

位置づけを整理すると、次のようになります。

  • 発表日:2026年9月24日(米国時間)。Google の公式ブログ(Gemini models カテゴリ)と、Google Cloud ブログの一般提供の告知が同日に出ています
  • 提供の段階:一般提供(GA)。Google Cloud ブログは「Google Cloud Next 2026 で先行公開した技術が、企業の本番利用に向けて正式に使えるようになった」と書いています
  • モデル:gemini-3.8-live。Google Cloud のモデルページでは、リリース日が2026年9月24日、提供段階が GA と記載されています
  • 表示できる場所:Google Cloud ブログは「ウェブ、モバイル、対話型のキオスク端末」で動く会話型の映像エージェントを想定していると書いています

注意したいのは、これが「Gemini アプリの新しい見た目」ではない点です。発表ブログの本文は、この機能の提供先を Gemini Enterprise だけと書いています。スマホの Gemini アプリで Live を開くと顔が出てくる、という機能ではありません。企業が自社のサイトやアプリ、店頭の端末に「話すアバター」を組み込むための部品、と捉えるのが正確です。

できること4つ|口の動き・表情・裏でのツール実行・言語の切り替え

発表ブログと Google Cloud ブログ、開発者向けガイドに書かれている機能を、法人の目線で4つに分けました。いずれも公式の記載の範囲です。

Live Avatarでできること4つ。口と表情が動く映像(24 FPSの映像をモデルが出力)、裏でツールを実行(会話を止めずにデータを取得)、途中で言語を切り替え(発表ブログは97言語と記載)、アバターを選ぶ・作る(カスタムは許可リスト制)

1. 音声に合わせて口と表情が動く映像を出す

発表ブログは「正確なリップシンク(口の動きの同期)、自然な表情、滑らかな話者交代」を特長に挙げています。開発者向けガイドによると、映像は 24 FPS の MP4 で、モデルが直接出力します。外部の映像生成の仕組みを別に用意する必要はありません。モデルカードは「設定した画像と音声の入力にもとづき、自然な頭の動きと発話に同期した表情豊かな映像を生成する」と説明しています。

2. 会話を止めずに裏でツールを呼ぶ

アバターが話し続けている間に、裏でツールを呼び出してデータを取りに行けます。発表ブログでは、ホテルのチェックインの例が紹介されています。予約の確認のような処理を裏で進めながら、会話は途切れずに続きます。これは Gemini 3.8 Live 本体の特長(非同期のツール呼び出し)を、アバターでもそのまま使えるということです。

3. 会話の途中で言語を切り替える

発表ブログは「97の言語の間で、映像の品質を落とさずに切り替えられ、口の動きと表情も言語に合わせて変わる」と書いています。一方、Google Cloud の Live API の概要ページは「24の言語で会話できる」と書き、対応言語の一覧(日本語 ja-JP を含む24言語)を載せています。2026年9月29日時点で、この2つの数字の関係は公式に説明されていません。日本語で使う場合は、Live API の対応言語一覧に ja-JP があることを確認したうえで、実際の画面で試すのが確実です。

4. 用意されたアバターを選ぶか、自社用に作る

Google が用意したアバターの一覧から選び、同じく用意された音声と組み合わせて使えます。これに加えて、参照画像を1枚用意すると、その見た目のアバターを作れます。ただしカスタムアバターは、企業ごとの許可リスト(allowlist)と確認の手続きを通った顧客だけが使える機能です。詳しくは後の章で扱います。

使える場所と条件|Gemini Enterprise・Live API・対応リージョン

「どこで、誰が使えるのか」を、公式ページに書かれている範囲で表にしました。空欄にせず、公式に記載がない項目はそう書いています。

使える場所と条件。提供先はGemini EnterpriseとLive API、提供段階は一般提供で9月24日から、対応リージョンはus・eu・us-central1、個人向けのアプリは公式に記載なし

項目公式の記載(2026年9月29日時点)出典
提供先Gemini Enterprise(Google Cloud の Gemini Enterprise Agent Platform)と Gemini Live API発表ブログ・Google Cloud ブログ
試す画面Google Cloud コンソールの Agent Platform > Studio > Stream realtime でモデル gemini-3.8-live を選び、「Live Avatar」を選択Configure live avatars
提供段階一般提供(GA)。リリース日は2026年9月24日モデルページ
対応リージョンマルチリージョン us・eu、米国 us-central1(従量課金と Provisioned Throughput の両方)モデルページ
日本のリージョン2026年9月29日時点で公式に記載なしモデルページ
対応言語発表ブログは97言語。Live API の概要ページは24言語(日本語 ja-JP を含む)発表ブログ・Live API 概要・言語と音声の設定
表示する端末ウェブ、モバイル、対話型のキオスク端末を想定(組み込み先は利用企業が作る)Google Cloud ブログ
Gemini アプリ(個人向け)2026年9月29日時点で公式に記載なし。Gemini アプリのヘルプと料金ページにアバターの記載はないGemini アプリのヘルプ・料金ページ
Google AI Pro・Ultra2026年9月29日時点で公式に記載なしGoogle AI の料金ページ
Gemini API(Google AI Studio)開発者向けの Live API のページにアバターの記載はない(2026年9月29日時点)Gemini API ドキュメント
日本での提供時期2026年9月29日時点で公式に記載なし各公式ページ

表の中で法人が一番気にすべきなのは、対応リージョンです。モデルページに載っているのは米国と欧州だけで、東京や大阪は2026年9月29日時点で一覧にありません。個人情報を含む会話を扱う場合、データを処理する場所について社内の規程や契約で決まりがある会社は多いはずです。この点は「使えるかどうか」より先に、情報システム部門と法務で確認が必要です。

なお、Gemini Enterprise Agent Platform は、以前 Vertex AI と呼ばれていたサービスの現在の名称です。名称変更の経緯は Vertex AI名称変更|Gemini Enterpriseへ改名と移行 にまとめています。

料金|映像出力は100万トークン1ドル・話している間だけ課金

Google Cloud の生成 AI の料金ページには、Gemini 3.8 Live API の行にアバターの映像出力(Output: video (avatar))が載っています。単価はすべて100万トークンあたりで、リージョンは「Non-global」(us・eu などの地域指定)です。円は1ドル150円で換算しています。

アバターの映像出力の料金。単価は100万トークン1.00ドル、映像1秒は6,192トークン、話している1分は約0.37ドル(約56円)。聞いている間は課金されない

種類100万トークンあたり円換算(1ドル150円)
入力:テキスト0.75ドル約113円
入力:映像・画像1.00ドル約150円
入力:音声3.00ドル約450円
出力:テキスト(応答と推論)4.50ドル約675円
出力:音声12.00ドル約1,800円
出力:映像(アバター)1.00ドル約150円

料金ページの注記には、トークンへの換算の目安が書かれています。アバターの映像出力は「映像1秒あたり6,192トークン」、音声は「1秒あたり25トークン」です。さらに「映像出力の課金はアバターが実際に話している間だけで、聞いている間(待機中)は課金しない」と明記されています。

試算例(実測値ではありません):公式の換算値と単価から、映像出力の部分だけを計算すると次のとおりです。

  • 1秒:6,192トークン × 1.00ドル ÷ 100万 = 約0.0062ドル
  • 1分:6,192 × 60 = 371,520トークン → 約0.37ドル(約56円)
  • 10分:約3.72ドル(約557円)
  • 60分:約22.29ドル(約3,344円)

ここに含まれるのはアバターが話している時間の映像出力だけです。利用者の音声やカメラ映像の入力、テキストの出力などは別に課金されます。また料金ページの注記によると、Live API は1ターン(利用者の1回の入力とモデルの応答)ごとに、それまでの会話の文脈にあるトークンを含めて課金します。前のターンのトークンは、設定した文脈の上限までは毎ターン処理し直して課金されるため、会話が長くなるほど1ターンあたりの費用は上がります。本番の見積もりは、想定する会話の長さで Google Cloud の料金計算ツールを使うか、担当の営業に確認するのが確実です。

音声だけの Gemini 3.8 Live の料金の考え方は、既刊の Gemini 3.8 Live の解説 の料金の章でも扱っています。

9月15日のGemini 3.8 Liveからの続き|何が加わったか

今回の発表は、単独の新モデルではありません。9月15日(米国時間)に発表された Gemini 3.8 Live と 3.8 Live Extended Thinking の続きです。発表ブログの冒頭も「先週の Gemini 3.8 Live の公開に続いて」と書いています。時系列を並べると次のとおりです。

日付出来事出典
Google Cloud Next 2026Live Avatar の技術を先行公開Google Cloud ブログ
2026年9月15日Gemini 3.8 Live と 3.8 Live Extended Thinking を発表。モデルカード「Gemini 3.8 Audio」も同日に公開され、アバターの機能がオプションとして記載されたGoogle ブログ・モデルカード
2026年9月24日Gemini 3.8 Live with Live Avatar を発表。Gemini Enterprise で一般提供発表ブログ・Google Cloud ブログ
2026年9月28日Live API の概要・アバターの設定手順・モデルページが更新(各ページの最終更新日)Google Cloud ドキュメント

9月15日の時点で、Gemini 3.8 Live は Gemini API、Gemini アプリ、Google Workspace、Search Live で使えると案内されていました。これに対して、アバターは Gemini Enterprise の Live API に限った機能です。同じ「3.8 Live」でも、アバターが付くのは企業向けの経路だけ、という違いを押さえておくと読み違いを防げます。

同じ9月には、軽量モデルの Gemini 3.8 Flash や、パソコン向けの Gemini の Windows アプリ も発表されています。Gemini の9月の発表をまとめて追う場合は、あわせて確認してください。

この記事の内容を社内で使うなら

要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。

職場のAI活用提案キットを受け取る(無料)AI顧問に相談する(30分・無料)→

カスタムアバター|参照画像1枚から作れるが許可リスト制

検索では「Gemini アバター 作成」「作り方」も調べられています。カスタムアバターは、Google Cloud の設定手順のページで条件が細かく決められています。

まず利用の可否です。設定手順のページは「カスタムアバターは一部の顧客だけが使える。利用するには Google Cloud のアカウント担当に連絡する」と書いています。Google Cloud ブログも、なりすましや悪用を防ぐため、カスタムアバターの作成は企業ごとの許可リストと確認の手続きを通す、と説明しています。申し込めばすぐ使える機能ではありません。

参照画像の条件は次のとおりです(設定手順のページより)。

項目条件
形式PNG を推奨(透過で背景の枠が出ない)
色RGB
サイズ縦長は 704×1280 ピクセル以上、横長は 1280×704 ピクセル以上
解像度720p 以上
縦横比9:16(縦)と 16:9(横)が標準
ファイルサイズ5MB 未満
構図頭と肩が画面の60%を超えるバストショット。腕・手・マイクなどの持ち物は写さない。背景は無地で他の人を入れない。正面を向き、無表情(笑顔や歯を見せない)
使えない画像未成年、著名人、不快な内容の画像

権利の扱いも明記されています。設定手順のページは「顔や声のサンプルの処理に必要な同意と権利は、すべて利用者の責任で確保する」と書き、Google の生成 AI の禁止用途ポリシーと Google Cloud の利用規約に従うことを求めています。Live API の概要ページも、企業の顔となるアバターの例として「許可を得た従業員の姿、または契約を結んだタレント」から作る形を挙げています。社員の顔で作る場合は、本人の同意書と、退職したときの扱いまで先に決めておく必要があります。

顔の再現と規制の関係は、海外の事例を扱った 中国AI規制の対象は『死者の再現』|デジタルヒューマン も参考になります。

法人の使いどころと判断|窓口・案内・研修

公式が挙げている用途は、発表ブログでは「顧客対応」と「対話型の操作案内」、Live API の概要ページでは企業の顔となるアバター、EC・小売の接客、ゲーム、医療機関の案内、金融の日常的な問い合わせ、教育のメンターなどです。Google Cloud ブログには、Cox Automotive が Autotrader 向けに、画面上の強調表示とツール呼び出しを組み合わせた車探しのアシスタントを作った事例が載っています。

導入前に決める5つ。データを処理する場所、AIであることの告知、人への引き継ぎ、会話の長さは数分、費用の上限

これを日本の中小企業・中堅企業に当てはめると、候補は次の3つです(公式の用途例にもとづく当社の整理で、実際の導入事例ではありません)。

  • ウェブサイトやアプリの案内窓口:よくある質問に顔つきで答え、予約や在庫の確認は裏のツールで進める。ホテルのチェックインの例に近い形です
  • 店頭や受付のキオスク端末:来訪者の案内や手続きの説明。Google Cloud ブログがキオスク端末を想定先に挙げています
  • 社内の説明・研修:新しい制度や操作手順を、質問を受けながら説明する役。教育のメンターという用途例に当たります

一方で、導入前に決めることも多い機能です。次の5つが決まらないうちは、試験の段階から先に進めない方が安全です。

  1. データを処理する場所:対応リージョンは米国と欧州。社内規程や顧客との契約で国内処理が必要な情報を扱わない設計にするか
  2. AI であることの告知:画面に「AI が応答しています」と表示するか。SynthID の透かしは目に見えないため、利用者への告知は別に必要です
  3. 人への引き継ぎ:苦情、契約、健康や金銭に関わる相談を、どの時点で人に渡すか
  4. 会話の長さ:モデルカードは、アバター付きの対話は「数時間ではなく数分の連続した対話」に対応すると書いています。長時間の接客の置き換えではなく、短い案内に絞る方が合っています
  5. 費用の上限:話している時間と会話の長さで費用が変わるため、1日あたりの上限と監視の方法を決めておく

顧客窓口に AI を入れる全体の考え方や、電話応対への応用は、音声だけの使い方も含めて Gemini 3.8 Live の解説 の「法人で効く使いどころ」の章が参考になります。

映像と顔の扱い|同意・SynthID・データの置き場所

アバターは「本物の人に見える映像」を作る機能なので、音声だけの AI より気をつける点が増えます。公式の記載にもとづいて整理します。

電子透かし(SynthID):発表ブログと Google Cloud ブログは、生成した音声と映像のすべてに、人には知覚できない SynthID の透かしが入ると書いています。AI が作ったものだと後から確認できるようにするための仕組みです。ただし透かしは画面上に表示されないため、利用者に AI であることを伝える役目は果たしません。告知は自社の画面で行う必要があります。

用意されたアバターを基本にする:Google Cloud ブログは、なりすましを防ぐために「用意されたアバターの一覧から使う」ことを基本にし、カスタムアバターは許可リスト制にしたと説明しています。最初の試験は用意されたアバターで行い、社員やタレントの顔を使うのは効果が確かめられてから、という順番が無理のない進め方です。

企業向けの管理機能:Google Cloud ブログは、us と eu のエンドポイント、Provisioned Throughput(処理量の事前確保)、企業向けのコンプライアンス、厳格なデータガバナンスを挙げています。モデルページのセキュリティ管理の欄には、データレジデンシー、CMEK(顧客管理の暗号鍵)、VPC-SC などが並んでいます。自社の Google Cloud の契約でどこまで使えるかは、情報システム部門で確認してください。

モデルの限界:モデルカードは、幻覚(事実と異なる応答)など基盤モデル一般の限界があること、ときどき遅延やタイムアウトが起きうることを挙げています。窓口で料金や在庫を答えさせる場合は、答えを必ずツール経由の実データから取る設計にしておく必要があります。

Live APIのモデル比較|アバターが使えるのは3.8 Liveだけ

他社の同種機能については、2026年9月29日時点で、この記事で条件と料金を公式ページどうしで並べられる材料がそろっていないため、比較表を載せません。推測で並べると読み違いのもとになるためです。ここでは、Google Cloud の Live API で選べるモデルの違いを、公式の表から抜き出します。

モデル ID提供段階アバター主な用途(公式の記載)
gemini-3.8-live一般提供対応(24 FPS の映像)低遅延の音声エージェント。多言語の切り替え
gemini-live-2.5-flash-native-audio一般提供非対応低遅延の音声エージェント。多言語の切り替えと感情のこもった口調
gemini-3.5-transcribe-live-previewプレビュー非対応文字起こし専用。会話はしない

開発者向けガイドの比較表でも、Gemini 2.5 Flash Live API Native Audio はアバターの合成が「非対応」と書かれています。すでに 2.5 の Live API で音声エージェントを動かしている会社が、アバターを付けたい場合は 3.8 Live への移行が前提になります。Google は移行手順のページも用意しています。なお、モデルページによると gemini-3.8-live は思考(Thinking)機能に対応しておらず、推論を強めた 3.8 Live Extended Thinking は Google Cloud ブログの時点で限定プレビューのままです。

試すときに使えるシステム指示のひな形5つ

Live API では、アバターの振る舞いをシステム指示(system instruction)で決められます。設定手順のページにも、コンソールの画面で任意にシステム指示を入れる手順があります。以下は、試験の段階で使える日本語のひな形です。社名や担当範囲は自社に合わせて書き換えてください。

1. ウェブの案内窓口

あなたは株式会社〇〇のウェブサイトの案内係です。日本語で、1回の返答は2〜3文にまとめてください。
最初の返答で「AIの案内係です」と名乗ってください。
答えられるのは、営業時間・所在地・サービスの概要・予約の方法だけです。
料金・在庫・予約の空きは、必ずツールで確認した結果だけを伝えてください。確認できない時は「担当者からご連絡します」と伝えてください。

2. 人への引き継ぎを決める

次の話題が出たら、その場で答えを出さず、人の担当者に引き継ぐ案内をしてください。
・苦情や返金の相談
・契約内容の変更や解約
・健康、法律、お金に関わる個別の相談
引き継ぐ時は「担当者におつなぎします。お名前とご連絡先を伺えますか」と伝えてください。

3. ツールの呼び出しの上限(公式の推奨にもとづく)

ツールの結果が見つからなかった場合は、条件を変えて何度も検索せず、見つからなかったことを利用者に伝えてください。
利用者に話しかけずに、2回を超えて続けてツールを呼び出さないでください。
ツールで確認している間は「確認しますので少々お待ちください」と一言伝えてください。

4. 社内研修の説明役

あなたは社内の新しい経費精算の手順を説明する係です。
説明は「申請」「承認」「支払い」の順に、1回に1つの手順だけ話してください。
質問を受けたら、社内規程の文書に書かれている内容だけで答えてください。文書に無いことは「総務部に確認してください」と伝えてください。
説明の最後に、理解できたかを1問だけ質問してください。

5. 言語の切り替え

利用者が話した言語で返答してください。途中で言語が変わったら、その言語に合わせてください。
ただし、店舗名・商品名・住所は日本語の表記のまま伝えてください。
対応できない言語の時は、日本語か英語での対応をお願いしてください。

3つ目のひな形は、開発者向けガイドの「必ず守る API のルール」に沿っています。ガイドは、ツールが結果を返さない時に 3.8 Live は条件を変えて再検索しようとするため、システム指示に再試行の上限を書くことを求めています。

【要注意】Gemini 3.8 Live Avatarの読み違い4つ

❌ Gemini アプリでも顔つきの Live が使えるようになった
⭕ 発表ブログの本文は、提供先を Gemini Enterprise と書いています。Gemini アプリのヘルプと料金ページには、2026年9月29日時点でアバターの記載はありません。個人向けの有料プラン(Google AI Pro・Ultra)で使えるという公式の記載もありません。

❌ 97言語すべてで日本語と同じように使える
⭕ 97言語は発表ブログの数字で、Live API の概要ページは24言語と書いています。日本語(ja-JP)は24言語の一覧に入っています。業務で使う言語は、一覧とコンソールの画面の両方で確認してください。

❌ 社員の写真を1枚入れれば、すぐに社員そっくりのアバターが作れる
⭕ カスタムアバターは許可リスト制で、Google Cloud のアカウント担当への申し込みが必要です。顔と声の利用に必要な同意と権利は、利用企業が確保する責任を負います。

❌ 1分56円なので、1時間の接客でも3,000円程度で収まる
⭕ 1分約56円は、アバターが話している時間の映像出力だけの試算です。入力の音声や映像、テキストの出力は別に課金され、会話が長くなるほど毎ターン処理し直す文脈のトークンも増えます。さらにモデルカードは、アバター付きの対話は「数分」の連続に対応すると書いています。長時間の連続した接客を前提にした見積もりは、公式の想定と合いません。

よくある質問

Gemini 3.8 Live Avatarは無料で使えますか?

2026年9月29日時点で、無料で使える枠についての公式の記載は見当たりません。Google Cloud の料金ページでは、アバターの映像出力が100万トークンあたり1.00ドル(約150円)の従量課金として載っています。

Gemini アプリ(スマホ)で使えますか?

2026年9月29日時点で公式に記載はありません。発表ブログは提供先を Gemini Enterprise としています。スマホの Gemini アプリの Live で顔が表示される、という案内は Gemini アプリのヘルプにもありません。

日本語に対応していますか?

Google Cloud の Live API の対応言語一覧に日本語(ja-JP)が入っています。発表ブログは97言語の切り替えに対応すると書いています。ただし日本のリージョンでの提供は、2026年9月29日時点でモデルページの一覧に記載がありません。

料金はいくらですか?

アバターの映像出力は100万トークンあたり1.00ドル(約150円)で、映像1秒は6,192トークンに換算されます。映像出力だけで計算すると、アバターが話している1分あたり約0.37ドル(約56円)です。聞いている間は課金されません。入力の音声や映像などは別の単価で課金されます。

自社のキャラクターや社員の顔でアバターを作れますか?

カスタムアバターとして作れますが、一部の顧客に限った機能です。Google Cloud のアカウント担当に申し込み、許可リストと確認の手続きを通す必要があります。参照画像は PNG 推奨、704×1280 ピクセル以上、5MB 未満などの条件があり、未成年や著名人の画像は使えません。

どうやって試せますか?

Google Cloud コンソールで Agent Platform > Studio > Stream realtime を開き、モデル gemini-3.8-live を選んで「Live Avatar」を選択します。アバターと音声を選び、必要ならシステム指示を入れてセッションを開始します。API から使う場合は、応答の種類を VIDEO にし、アバターの名前を指定します。

まとめ

Gemini 3.8 Live Avatar は、9月15日の Gemini 3.8 Live に「話す顔」を加えた、企業向けの Live API の機能です。9月24日から Gemini Enterprise で一般提供が始まり、映像出力は100万トークンあたり1.00ドル(約150円)、話している1分あたりの映像出力は約56円の計算になります。一方で、対応リージョンは米国と欧州だけ、カスタムアバターは許可リスト制、連続した対話は数分が想定、と公式に書かれた条件も多くあります。

最初の一歩は、用意されたアバターで、よくある質問3つ程度に答える案内役をコンソール上で試すことです。そのうえで、データを処理する場所、AI であることの告知、人への引き継ぎ、費用の上限の4点を社内で決めてから、自社サイトや店頭への組み込みを検討する順番が無理のない進め方です。当社では、Gemini を含む生成 AI の業務への組み込みと社内ルールづくりを支援しています。検討の段階で整理したいことがあれば お問い合わせ からご相談ください。

参考・出典

PDF 32ページ

この記事の内容を社内で使うなら

事例を自社で試す時の、業務の選び方・安全に試す手順・上司に見せる1枚提案書のテンプレートです。

  • 上場企業を含む100社以上
  • 累計4,000名以上
  • 助成金対応(要件審査あり)

資料は受け取りページからすぐにご覧いただけます。

佐藤傑
この記事を書いた人 佐藤傑

株式会社Uravation 代表取締役CEO/生成AIエバンジェリスト。法人向けAI研修・コンサルティングを手がけ、日経・SBクリエイティブ・GMO等のメディアで生成AIについて執筆。

この記事をシェア

Contact お問い合わせ

30分の無料相談では、いま時間を取られている業務を伺い、稼働中のAI社員62体の事例の画面と一緒に近い進め方をお見せします。
売り込みはしません。

Claude Code 個別指導(1対1・12セッション)をご希望の方はこちら、Codex 個別指導はこちらから別途お申し込みください

Claude Code 個別指導 無料相談