GoogleのGemini 3.8 Liveモデルが音声ベンチマークでトップに

Googleは9月15日に新しいGemini 3.8 LiveおよびExtended Thinking音声モデルを発表しました。Extended ThinkingはArtificial Analysis指数で82.6を記録しトップです。

16/09/2026 06:11約 6 分で読めます

9月15日、GoogleはGemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを発表し、これまでで最も高性能な音声モデルであると述べました。

これらのモデルは会話、推論、タスク実行が可能です。独立系アナリストがランク付けを行い、Extended ThinkingバリアントはArtificial AnalysisのSpeech-to-Speech指数で82.6のスコアを獲得し、GPT-Live-1およびGrok Voiceを上回りました。

自然でプロダクション対応の音声アプリケーション向けに構築された、最新の高度な音声モデルに「hi」と言ってください。@GoogleDeepMindから提供されています。

🔷 Gemini 3.8 Live
🔷 Gemini 3.8 Live Extended Thinking

これらのモデルを使えば、自然に話し、簡単にコラボレーションし、複雑なタスクに取り組むことができます… pic.twitter.com/TCcuANcIWl

— Google (@Google) September 15, 2026

Google最新会話型AIのベンチマークランキング

Artificial Analysisの指数は、音声推論、エージェントパフォーマンス、アリーナの好み、タスク成功率のスコアを組み合わせています。

高い推論努力でテストした場合、Gemini 3.8 Live Extended Thinkingがトップの座を獲得しました。GPT-Live-1 Astraが81.5で続き、Grok Voice Think Fast 2.0 Highが81.3を獲得しました。

通常のGemini 3.8 Liveは76.0で5位にランクされました。両方の新モデルは、71.5だったGemini 3.1 Flash Live Highを上回りました。

エージェント能力の差はさらに大きいです。Extended ThinkingはTau Voiceベンチマークで68.6%を達成し、以前のモデルの37.7%と比較されます。

音声推論では、Extended Thinkingが97.7%を記録し、Grok Voiceの97.2%をわずかに上回りました。ただし、99.2%に達したQwen Audio 3.0 Realtime Plusには及びませんでした。

旧型Geminiモデルが依然として人間のテスターに好まれる

価格設定には明確な違いがあります。標準モデルは入力音声1時間あたり0.84ドルで、前世代の1.75ドルの約半分であり、指数内で最も安価です。

Extended Thinkingの価格は1時間あたり3.50ドルで、GPT-Live-1 Solの4.47ドルやGrok Voice Think Fast 2.0 Highの4.80ドルよりも低くなっています。

レイテンシも改善されました。最初の音声までの平均時間は、旧モデルの2.99秒から1.18秒に短縮されました。

しかし、人間のリスナーは完全には納得していません。ブラインドのSpeech Agent Arena会話では、Gemini 3.1 Flash LiveがEloレーティング1096で引き続き好みでリードしています。

Gemini 3.8 Liveは1083で2位、Extended Thinkingバージョンは990で遅れを取っていますが、タスクの89.1%を完了しています。

音声AI評価は現在、逆方向に向かう2つの異なる指標を使用しています。ベンチマークは最も強力な推論を持つモデルを好み、好みスコアは最も優れた会話者を好みます。Googleは両方のカテゴリーでリードしていますが、異なるモデルです。

共有先

X (Twitter)Telegram

免責事項:本記事の内容は第三者メディアからの引用であり、参考情報としてのみ提供されます。投資助言を構成するものではありません。暗号資産およびその他の金融商品には大きな価格変動リスクがありますので、ご自身で慎重にご判断ください。

関連記事