HeadlinesBriefing favicon HeadlinesBriefing.com

Gemini 3.8 Flash TTS 发布:支持 expressive 语音生成

Hacker News •
×

Google AI 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,作为其最具 expressive 的音频生成模型。这些模型使创作者能够在 Google AI Studio、Gemini API 和 Google Vids 中生成自定义角色语音和直接场景对话。Gemini 3.8 Flash TTS 专为深度创意指导而构建,允许用户使用自然语言提示从零开始创建全新声音。用户可以逐行指导每个表演行,对表演提示、节奏、方言转换和背景对话进行精细控制。Gemini 3.8 Flash-Lite TTS 为配音和 expressive 语音代理提供高容量、成本高效的规模,并对语气和节奏进行精细控制。这些模型补充了 Google 不断增长的 Gemini Audio 系列,并提供对 100 多种语言和方言中 2,000 多个即用型声音的访问。关键实体:公司:Google、Google AI;人物:Alan Cowen。FAQ:Gemini 3.8 Flash TTS 的主要功能是什么?Gemini 3.8 Flash TTS 支持使用自然语言提示从零开始创建定制语音、逐行精细表演控制、访问 100 多种语言中 2,000 多个即用型声音,以及在同意验证后从 30 秒音频样本复制语音。FAQ Q:Gemini 3.8 Flash TTS 的主要功能是什么?FAQ A:Gemini 3.8 Flash TTS 支持使用自然语言提示从零开始创建定制语音、逐行精细表演控制、访问 100 多种语言中 2,000 多个即用型声音,以及在同意验证后从 30 秒音频样本复制语音。