📊モデルリリースまさおAIじっくり解説ch

Googleが放つ最強コスパのリアルタイムAI「Gemini 3.8 Live」登場

2026年9月、Googleから新たなリアルタイム音声対話モデル「Gemini 3.8 Live」と「3.8 Live Extended Thinking」が発表されました。本動画では、これら新モデルの圧倒的なコストパフォーマンスと、競合他社を凌駕する高いベンチマーク性能、そして実際のAI Studioでの使用感について、最新の検証データを交えて詳しく解説しています。

背景

リアルタイム音声対話AIの分野では、GPTのリアルタイム機能やGrokの「Voice Think Fast 2.0」といったモデルが登場し、1分あたりの利用料が数ドルかかるなど高コストな状況が続いていました。こうした中、Googleは品質を維持しつつコストを劇的に抑えた新モデルを投入。2026年9月15日の公式ブログで詳細が明かされ、AI Studioでの提供も開始されました。

この動画の要点

1. 「Gemini 3.8 Live」はコスト効率を重視し、「3.8 Live Extended Thinking」は高難度タスクに対応します。特にExtended Thinkingは、会話を中断せずに多段推論を実行できる点が特徴で、ベンチマーク「AA Speech to Speech Index」において82.6というスコアを記録し、世界1位を獲得しています。

2. 圧倒的な低コストが最大の武器です。1時間あたりの音声入力コストにおいて、Gemini 3.8 Liveは約0.84ドルと、Grokの3.50ドルやGPT-Live-1 Astraの5.83ドルと比較して極めて安価です。Astraと比較すると約7分の1の費用で利用可能であり、サービスへの組み込みやすさが飛躍的に向上しています。

3. 機能面では、視覚入力をほぼリアルタイムで処理し会話に反映できるほか、97言語の自動検出、会話中のツール呼び出しやAPI連携が可能です。また、生成音声には「SynthID」の透かしが入る仕様となっています。AI Studioでは推論の深さを「Low/Medium/High」から選択でき、用途に応じた調整が可能です。

なぜ重要か

本モデルの登場は、リアルタイムAIの社会実装を加速させる重要な転換点となります。これまで音声対話AIは高額なAPI利用料がネックとなり、長時間の利用や大規模なサービス展開には課題がありました。しかし、Gemini 3.8 Liveが競合の数分の一のコストを実現したことで、銀行の顧客対応やパーソナルアシスタントといった実用的なエージェント開発のハードルが劇的に下がります。また、単に安いだけでなく、エージェントとしての完遂率や銀行業務シミュレーションにおいてもトップクラスの精度を維持しており、「安かろう悪かろう」ではない実力を見せつけています。

こんな人におすすめ

AI開発者、生成AIの最新動向を追うビジネスパーソン、音声対話エージェントの導入を検討しているエンジニア。

見どころ

この記事は まさおAIじっくり解説ch が公開した動画をAI(Google Gemini)が視聴して 日本語にまとめ、公開前に運営者が内容を確認したうえで掲載しています。 要約の性質上、細部が元の発言と異なる場合があります。 正確な内容は元の動画をご確認ください。

YouTubeで元の動画を見る

スポンサーリンク