Gemini 3.8 Liveとは?何が変わった?対応サービス・日本語・料金を解説
初回掲載日:2026/09/16
最終更新日:

Googleは2026年9月15日、リアルタイム音声会話向けの「Gemini 3.8 Live」と、複雑な処理向けの「Gemini 3.8 Live Extended Thinking」を発表しました。
先に結論:速い会話は3.8 Live、複雑な計画や長いツール処理はExtended Thinking
2つは同じLive APIの別モデルです。どちらも音声を中心に使えますが、Extended Thinkingはバックグラウンドで推論・非同期ツール実行を進めながら、途中経過を音声で伝えられる点が大きな違いです。
gemini-3.8-live-extended-thinking
Gemini 3.8 Liveとは?
Gemini 3.8 Liveは、音声を入力すると音声で返すリアルタイム対話向けのモデルです。Googleの公式モデルページでは、低遅延の音声エージェントや自然な会話の標準的な選択肢として位置付けられています。
従来のチャットのように、話す、処理を待つ、文章を読むという流れだけでなく、会話のテンポを保ちながら音声・画像・動画の情報を扱える点が特徴です。モデルコードはgemini-3.8-liveで、Live APIに対応しています。
なお、ここでいう「Live」はGeminiアプリの製品名そのものではなく、開発者が音声エージェントを組み込むためのモデル・APIを指す場面があります。一般ユーザー向けアプリや検索機能での表示名、提供条件は別途確認が必要です。
Gemini 3.8 LiveとExtended Thinkingの違い

Extended Thinkingは、単に回答を遅くするモードではありません。複雑な要求を分解し、複数のツールを非同期で呼び出し、処理中も「確認しています」のような音声の合間を返して会話を止めにくくするモデルです。
Gemini 3.8 Live
- 低遅延の自然な音声会話
- 直接的な質問や短い操作
- リアルタイムのターン交代
- 同期・非同期のFunction Callingに対応
Live Extended Thinking
- 複雑な計画・多段階処理
- 長めのツール処理を背景で実行
- 処理中の音声フィラーで会話を維持
- low / medium / highの推論レベル
開発者がExtended Thinkingを使う場合、ツール宣言は非同期のNON_BLOCKINGにする必要があります。また処理中か完了かを、通常のturnCompleteだけでなくinteraction_statusのIN_PROGRESS / IDLEで扱います。
何が変わった?主な特徴
1. 会話しながらツールやAPIを実行
3.8 Liveでは、会話を受けながら外部ツールを呼び出せます。例えば、スマートホームの状態を確認する、短い検索結果を取得する、といった処理です。処理時間が長いワークフローでは、Extended Thinkingが非同期処理と相性のよい選択肢になります。
2. カメラや画面などの視覚情報を扱う
公式モデルページの入力対応には画像・音声・動画が含まれます。カメラで見せたものを質問したり、画面や資料を見せて説明を求めたりする構成を作れます。ただし、どのコンシューマー向けサービスでどの入力が利用できるかは、サービスごとの展開状況を確認してください。
3. 多言語の会話
Googleの発表では、会話中の言語切り替えを含む97言語対応が案内されています。日本語も対応言語に含まれますが、実際の音声機能はサービス、地域、アカウント、API設定などで条件が変わるため、「すべての場所で日本語が同じように使える」とは考えない方が安全です。
4. 会話の状態をクライアントで扱いやすく
3.8 Liveでは、セッション中のクライアントコンテンツ更新や音声ストリーミングが整理されています。Extended Thinkingでは、処理中と待機状態をinteraction_statusで追跡できるため、アプリ側で「考え中」「結果を受信済み」といった表示を作りやすくなります。
どこで使える?Geminiアプリ・Search・Workspace・API
発表時点のGoogle公式案内では、開発者向けのGemini APIとGoogle AI Studio、企業向けのプレビュー、一般向けのGeminiやSearchなど複数の展開先が示されています。ただし、同じモデルがすべてのサービスに同時提供されるわけではありません。
| 利用場所 | 整理 | 注意点 |
|---|---|---|
| Gemini API | 3.8 Live / Extended ThinkingのモデルIDを使った開発 | APIキー、利用規約、従量課金 |
| Google AI Studio | 開発者がモデルを試す入口 | 利用可能なモデル・無料枠は変動 |
| Geminiアプリ | Gemini Liveなど一般向け機能 | アプリ、地域、プランごとに提供条件 |
| Search / Workspace | 音声で検索や作業を進める展開 | 対象プラン・段階提供・地域差に注意 |
したがって、「Gemini 3.8 Liveを使うには必ず有料プランが必要」「無料で無制限」といった一括りの説明はできません。自分が使いたい場所の案内を確認するのが確実です。
無料で使える?料金は?
Gemini APIの公式料金ページでは、3.8 Live系についてFree Tierの入力・出力が「Free of charge」、Paid Tierは音声入力が1分あたり0.005ドル、音声出力が1分あたり0.018ドルと掲載されています。テキスト・画像・動画のトークン課金も別に表示されます。
これはAPIの料金表です。Geminiアプリ、Search、Workspaceの利用料金や利用上限とは別なので、アプリの無料利用範囲をそのままAPI料金表から判断することはできません。無料枠にも上限や対象機能があり得るため、利用前に最新の料金ページを確認してください。
APIでは、音声を何分送ったか・何分生成したかで費用が変わります。無料枠の有無と、すべての機能を無料・無制限で使えることは別です。料金はドル表記で確認し、円換算は為替で変動します。
開発者向け:APIで何ができる?

3.8 Liveの公式ドキュメントで確認できる主な要素は、音声ストリーミング、画像・動画入力、Function Calling、非同期処理、セッション中のコンテンツ更新です。Extended Thinkingでは、推論レベルをlow、medium、highから調整できます。
既存のLive APIアプリから移行する場合は、モデル文字列をgemini-3.8-liveへ変更し、3.8 Liveではthinking_levelを設定しない点に注意が必要です。Extended Thinkingでは、非同期Function Callingとinteraction_statusの処理を組み込みます。
API料金の目安
公式のPaid Tierは、音声入力が$0.005 / 分、音声出力が$0.018 / 分です。1分単位の単純な定額料金ではなく、実際の使用量や請求条件に基づくため、見積もり時は入力と出力を分けて計算します。
音声にはSynthID
Googleの発表では、新しい音声モデルが生成する音声にSynthIDのウォーターマークを適用すると説明されています。これは人が耳で聞き分けるための音ではなく、AI生成音声の出所を確認しやすくするための不可知覚の仕組みとして紹介されています。
どんな人に向いている?
3.8 Live向き
- 会話のテンポを最優先したい
- 音声検索や案内を作りたい
- 短いツール処理を組み込みたい
- シンプルな状態管理で始めたい
Extended Thinking向き
- 複数ステップの計画を任せたい
- 長い外部処理の待ち時間を隠したい
- ログ調査やコード指導を音声化したい
- 推論レベルを調整したい
一般ユーザーは、まず自分のGeminiアプリやSearchに表示される機能を確認すれば十分です。開発者は、モデルID、ツールの同期・非同期、料金、レスポンス状態の扱いまで含めて選ぶと、導入後の作り直しを減らせます。
FAQ
Q. Gemini 3.8 Liveとは?
A. Googleの低遅延なリアルタイム音声エージェント向けモデルです。音声に加えて画像・動画も入力できます。
Q. いつから使える?
A. 2026年9月15日に発表され、開発者向けドキュメントではモデルページが公開されています。一般向けサービスは展開先ごとに提供時期・条件が異なります。
Q. 無料で使える?
A. API料金表にはFree Tierが掲載されていますが、上限や対象は利用環境ごとに異なります。アプリの無料利用範囲とAPI無料枠を混同しないでください。
Q. 日本語に対応している?
A. 発表では97言語対応が案内され、日本語も含まれます。ただしサービス・地域・プラン・アカウントによって利用可否や提供時期が異なる場合があります。
Q. 普通のGemini Liveとの違いは?
A. Gemini Liveは一般向けの機能名として使われる一方、Gemini 3.8 LiveはAPI上のモデル名です。利用サービスによって内部モデルや表示名が異なる可能性があります。
Q. Extended Thinkingとは?
A. 複雑な要求を背景で推論し、非同期ツールを実行しながら会話を維持するモデルです。内部の思考過程をそのまま公開する機能という意味ではありません。
Q. Geminiアプリから使える?
A. GeminiアプリのLive機能やSearchなどで関連機能が展開されますが、全員に同じモデル・機能が表示されるとは限りません。アプリの最新表示と公式案内を確認してください。
Q. API料金はいくら?
A. 現在の公式料金表では、Paid Tierの音声入力が$0.005/分、音声出力が$0.018/分です。料金は変更される可能性があるため、利用前に公式ページを確認してください。
Q. Androidアプリから利用できる?
A. Geminiアプリの提供状況はOS、地域、アカウント、機能ごとに異なります。Gemini 3.8 LiveのAPIモデルがAndroidアプリへ直接搭載されているかは、アプリ内の最新表示と公式ヘルプで確認してください。
公式情報
まとめ
Gemini 3.8 Liveは、低遅延の音声会話と映像入力、Function Callingを組み合わせるためのモデルです。Extended Thinkingは、複雑な計画や長いツール処理を背景で進め、会話を途切れさせにくい方向へ拡張します。
無料で使えるか、GeminiアプリやSearchで使えるか、API料金がいくらかは同じ答えになりません。利用場所ごとのプラン・無料枠・地域・言語条件を確認し、開発者は公式のモデルIDと料金表を正本にするのがポイントです。