Google AI 推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS
Google AI 正在推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,并称之为迄今表现力最强的音频模型。这两款模型可在超过 100 种语言中创建自定义语音,或使用超过 2,000 种现成语音。它们能引导来回对话、逐句控制表达,并加入笑声或表示正在倾听的“嗯”等提示。Google AI 表示,它们可以生成数小时连贯、无故障的音频。
Gemini 3.8 Flash TTS 用于从零设计声音人设,并提供逐句控制,面向游戏、有声书和播客等高保真制作。Gemini 3.8 Flash-Lite TTS 则用于自动调节语气与节奏,面向接近实时的语音代理,以及注重成本、大批量的配音和批量音频。