HeadlinesBriefing favicon HeadlinesBriefing.com

Gemini 3.8 Flash TTS é lançado com geração de voz expressiva

Hacker News •
×

Google AI apresenta Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS como seus modelos de geração de áudio mais expressivos até agora. Esses modelos permitem que criadores gerem vozes de personagens personalizadas e diálogos de cenas diretas no Google AI Studio, Gemini API e Google Vids. Gemini 3.8 Flash TTS é construído para direção criativa profunda, permitindo que os usuários criem vozes completamente novas do zero usando prompts de linguagem natural.

Os usuários podem dirigir cada linha de performance linha por linha com controle granular sobre pistas de atuação, ritmo, mudanças de dialeto e backchanneling. Gemini 3.8 Flash-Lite TTS oferece escala de alto volume e com eficiência de custos para dublagem e agentes de voz expressivos com controle fino sobre tom e ritmo. Os modelos complementam a crescente família Gemini Audio do Google e fornecem acesso a mais de 2.000 vozes prontas para produção em mais de 100 idiomas e dialetos.

Entidades-chave: Empresas: Google, Google AI; Pessoas: Alan Cowen. Perguntas frequentes: Quais são os principais recursos do Gemini 3.8 Flash TTS? Gemini 3.8 Flash TTS permite a criação de vozes sob medida do zero usando prompts de linguagem natural, controle granular de performance linha por linha, acesso a mais de 2.000 vozes prontas para produção em mais de 100 idiomas e replicação de voz a partir de amostras de áudio de 30 segundos com verificação de consentimento. Pergunta frequente Q: Quais são os principais recursos do Gemini 3.8 Flash TTS? Resposta frequente A: Gemini 3.8 Flash TTS permite a criação de vozes sob medida do zero usando prompts de linguagem natural, controle granular de performance linha por linha, acesso a mais de 2.000 vozes prontas para produção em mais de 100 idiomas e replicação de voz a partir de amostras de áudio de 30 segundos com verificação de consentimento.