# Gemini 3.8 LiveがArtificial Analysis音声対音声指標で首位、音声1時間あたり0.84ドル

GoogleのGemini 3.8 Live Extended ThinkingモデルがArtificial AnalysisのSpeech to Speech Indexで首位を獲得し、標準モデルはブラインド形式の人間によるリアルタイム評価で2位となった。標準モデルの音声入力コストは1時間あたり0.84ドルで、同指標に掲載されている中で最安となっている。

Language: ja
Time zone: Asia/Tokyo

HTML: https://didcodexreset.com/ja/news/84742a27ff7a4982817743fb.html

Content language: ja
Localization state: translated

出典：DeepLearning.AI · 2026/10/8 01:06:28 公開

According to [The Batch](https://hubs.la/Q04ztmlL0)、GoogleのGemini 3.8 Live音声対音声モデルは、中間的なテキスト書き起こしを介さずに、単一システム内でネイティブに音声を聞き取り、推論し、応答する。Artificial AnalysisのSpeech to Speech Indexにおいて、Gemini 3.8 Live Extended Thinking版が総合1位を獲得し、標準モデルは人間が判定したブラインド形式のライブ対話評価で2位にランクインした。

Artificial Analysisのベンチマークによると、標準のGemini 3.8 Liveモデルの価格は音声入力1時間あたり0.84ドルで、同指標の中で最も低い価格帯となっている。標準モデルとExtended Thinkingモデルの双方が、音声ストリームと並行して画像や動画の直接入力にも対応しており、ユーザーは画面上のコンテンツについてアシスタントに質問できる。

Tags: Google Gemini, 音声対音声, Artificial Analysis, 音声AI

[元の投稿を見る](https://x.com/DeepLearningAI/status/2107856897193697459)
