跳到正文
Google DeepMind·· 16 天前精选

Google 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS

Gemini 3.8 text-to-speech says hello

研究任务与主要进展

Google 发布两款新的文本转语音模型:Gemini 3.8 Flash TTS 面向深度创作和角色设计,Gemini 3.8 Flash-Lite TTS 面向大规模配音和语音代理。

阶段、条件与复现 · 深读核对

  • 新能力对应什么具体任务与最小输入输出?
  • 代码、模型、数据、许可与可用入口是否明确?
  • 效果、总成本、失效条件与实际工作流如何验证?

这些是阅读核对问题;材料未说明的条件保留未知。请阅读原文核验。

本站判断

Google 发布面向创作与规模化语音应用的 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,新增自然语言声音设计、声音复刻、逐句表演控制和多说话人场景生成,并提供超过100种语言及方言支持。材料称其在 Hume AI 基准和 Voice Arena 盲测中位居前列,但具体效果仍取决于语言、场景和评测设置;声音复刻要求权利人语音同意,输出使用 SynthID 水印,企业版 API 则标注为即将推出。

来源:Google DeepMind · deepmind.google