平易な英語による概要
Gemini 3.8 Live Extended Thinking とは実際には何ですか
Extended Thinkingは、ライブ音声とバックグラウンドでの計画・ツール利用を組み合わせます。複数段階のリクエストを処理しながら進捗を音声で伝え、思考レベルを低・中・高から選択できます。
入力・出力の上限はGemini 3.8 Liveと同じです。Googleの掲載トークン単価も同じですが、追加の推論によって使用量が増える場合があります。一方、GPT-Live 1は高度な処理を別途選択したバックエンドエージェントに委任します。
ぴったりフィット
- 複数段階の音声サポート業務
- 音声で計画・調査を支援するアシスタント
- ツール呼び出し中に進捗を説明するエージェント
カテゴリ比較
声 モデルにとって重要な事実
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
- 価格ベース
- オーディオ $0.005/分入力 · $0.018/分出力リストされたアクセス ルートのトークン、文字、または分ベースの価格。
- インタラクションモード
- 視覚入力とバックグラウンド推論を備えた音声対話音声合成、音声合成、またはストリーミングされたテキスト読み上げの動作。
- 公表されたレイテンシ
- 非公開プロバイダーが公表した測定値と、明示された除外事項。 Cody テストではありません。
- 言語
- 多言語対応。現在のライブ API サポートを確認するプロバイダーが文書化した言語範囲または明確な未公開マーカー。
- ツールとコントロール
- 非同期関数のみ、検索によるグラウンディングネイティブ関数の呼び出し、推論、または音声制御機能。
- コンテキストまたは入力制限
- 131,072入力・65,536出力意味のある場合は、トークンまたは文字制限を文書化します。
APIとプロバイダーへのアクセス
Gemini 3.8 Live Extended Thinkingの入手場所
可用性
地域とアクセス段階
対応地域のGemini Live APIとGoogle AI Studioで利用できます。
Google のライブ利用可能リージョン リストを使用して、選択したルートの機能制限を確認します。
ライブの空き状況を確認するデータとトレーニング
ルートは重要です。
Googleは、有料のGemini APIプロンプトと応答は製品の改善には使用されないと述べています。通常、有料サービスのコンテンツは使用できますが、EEA、英国、スイスのユーザーに対しては異なる扱いになります。アカウントと地域の現在の規約を確認してください。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
Gemini 3.8 Live Extended Thinking よくある質問
Gemini 3.8 Live Extended Thinkingとは何ですか?
会話を続けながら複雑なリクエストをバックグラウンドで処理する、独立したGemini音声モデル。 Extended Thinkingは、ライブ音声とバックグラウンドでの計画・ツール利用を組み合わせます。複数段階のリクエストを処理しながら進捗を音声で伝え、思考レベルを低・中・高から選択できます。
Gemini 3.8 Live Extended Thinking はいつリリースされましたか?
引用されたプロバイダーの資料によると、Gemini 3.8 Live Extended Thinking は 2026年9月15日 でリリースされました。
Gemini 3.8 Live Extended Thinking にはどこからアクセスできますか?
対応地域のGemini Live APIとGoogle AI Studioで利用できます。 このガイドに記載されているアクセスルートは Google です。
Gemini 3.8 Live Extended Thinkingの価格はいくらですか?
$0.005/分オーディオ入力 · $0.018/分オーディオ出力. 有料枠の料金は100万トークンあたり音声入力3米ドル、音声出力12米ドルです。テキストは入力0.75米ドル・出力4.50米ドル、画像・動画入力は100万トークンあたり1米ドルです。推論や有料検索で費用が増える場合があります。
Gemini 3.8 Live Extended Thinking はどこで入手できますか?
対応地域のGemini Live APIとGoogle AI Studioで利用できます。 Google のライブ利用可能リージョン リストを使用して、選択したルートの機能制限を確認します。
私の Gemini 3.8 Live Extended Thinking API データはトレーニングに使用されますか?
Googleは、有料のGemini APIプロンプトと応答は製品の改善には使用されないと述べています。通常、有料サービスのコンテンツは使用できますが、EEA、英国、スイスのユーザーに対しては異なる扱いになります。アカウントと地域の現在の規約を確認してください。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
関連する比較
モデル別の詳細比較
Gemini 3.8 Live Extended Thinking vs GPT-Live 1
OpenAI の全二重音声フロントエンドは、自然な会話を実現し、より深い推論とアクションを別のバックエンド エージェントに委任します。
完全な比較を開くGemini 3.8 Live Extended Thinking vs Gemini 3.8 Live
音声・テキスト・視覚情報を使った応答性の高い会話向けのGoogleのリアルタイム音声モデル。
完全な比較を開くGemini 3.8 Live Extended Thinking vs GPT-Realtime-2.1
OpenAI のリアルタイム音声合成推論モデルは、テキストと画像のコンテキストも必要とするツールを使用する音声エージェント向けです。
完全な比較を開くGemini 3.8 Live Extended Thinking vs Gemini 3.1 Flash Live Preview
Google のプレビュー オーディオツーオーディオ モデル。マルチモーダルな認識、思考、検索グラウンディング、機能呼び出しを備えた低遅延対話を実現します。
完全な比較を開くGemini 3.8 Live Extended Thinking vs Eleven v3 Conversational
ElevenLabs の表現力豊かなリアルタイム テキスト読み上げモデルは、自然な対話、感情表現、オーディオ タグ、および 70 以上の言語に対応します。
完全な比較を開くGemini 3.8 Live Extended Thinking vs Inworld Realtime TTS-2
Inworld の最新の表現力豊かなリアルタイム テキスト読み上げモデル。会話の内容を記憶し、100 以上の言語で話すように設計されています。
完全な比較を開くGemini 3.8 Live Extended Thinking vs Grok Voice Think Fast 2.0
SpaceXAI の現在のリアルタイム音声合成モデルは、ツールにアクセスできる 1 秒未満の会話エージェント向けです。
完全な比較を開く