HeadlinesBriefing favicon HeadlinesBriefing.com

Gemini 3.8 Flash TTS se lanza con generación de voz expresiva

Hacker News •
×

Google AI presenta Gemini 3.8 Flash TTS y Gemini 3.8 Flash-Lite TTS como sus modelos de generación de audio más expresivos hasta la fecha. Estos modelos permiten a los creadores generar voces de personajes personalizadas y diálogos de escenas directas en Google AI Studio, Gemini API y Google Vids. Gemini 3.8 Flash TTS está diseñado para una dirección creativa profunda, permitiendo a los usuarios crear voces completamente nuevas desde cero usando indicaciones de lenguaje natural.

Los usuarios pueden dirigir cada línea de actuación con control granular sobre indicaciones de actuación, ritmo, cambios de dialecto y comentarios de fondo. Gemini 3.8 Flash-Lite TTS ofrece una escala de alto volumen y rentable para doblaje y agentes de voz expresivos con control fino sobre el tono y el ritmo. Los modelos complementan la creciente familia Gemini Audio de Google y proporcionan acceso a más de 2,000 voces listas para producción en más de 100 idiomas y dialectos.

Entidades clave: Empresas: Google, Google AI; Personas: Alan Cowen. Preguntas frecuentes: ¿Cuáles son las características clave de Gemini 3.8 Flash TTS? Gemini 3.8 Flash TTS permite la creación de voces personalizadas desde cero usando indicaciones de lenguaje natural, control granular del rendimiento línea por línea, acceso a más de 2,000 voces listas para producción en más de 100 idiomas y replicación de voz a partir de muestras de audio de 30 segundos con verificación de consentimiento. Pregunta frecuente Q: ¿Cuáles son las características clave de Gemini 3.8 Flash TTS? Respuesta frecuente A: Gemini 3.8 Flash TTS permite la creación de voces personalizadas desde cero usando indicaciones de lenguaje natural, control granular del rendimiento línea por línea, acceso a más de 2,000 voces listas para producción en más de 100 idiomas y replicación de voz a partir de muestras de audio de 30 segundos con verificación de consentimiento.