跳到正文
原文
Google DeepMind:Blog(RSS)· Leland Rechis·· 15 天前精选AI 评分74

Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

Gemini 3.8 text-to-speech says hello

AI 导读

Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。

推荐理由

官方介绍了两款 TTS 模型的能力细节、评测名次和开放入口,开发者可以据此评估语音生成工作流的选型。

整理与数据来源:AIHOT

来源:Google DeepMind:Blog(RSS) · deepmind.google