HeadlinesBriefing favicon HeadlinesBriefing.com

Gemini 3.8 Flash TTS अभिव्यक्तिमान आवाज़ जनरेशन के साथ लॉन्च हुआ

Hacker News •
×

Google AI ने Gemini 3.8 Flash TTS और Gemini 3.8 Flash-Lite TTS को अपने सबसे अभिव्यक्तिमान ऑडियो जनरेशन मॉडल के रूप में पेश किया। ये मॉडल रचनाकारों को Google AI Studio, Gemini API और Google Vids में कस्टम किरदार आवाज़ें और सीधे दृश्य संवाद जनरेट करने की अनुमति देते हैं। Gemini 3.8 Flash TTS गहन रचनात्मक दिशा के लिए बनाया गया है, जो उपयोगकर्ताओं को प्राकृतिक भाषा प्रेरणाओं का उपयोग करके शून्य से पूरी तरह से नई आवाज़ें बनाने की अनुमति देता है। उपयोगकर्ता प्रदर्शन संकेतों, गति, व्याकरण परिवर्तनों और बैकचैनलिंग पर सूक्ष्म नियंत्रण के साथ प्रत्येक प्रदर्शन पंक्ति को निर्देशित कर सकते हैं। Gemini 3.8 Flash-Lite TTS डबिंग और अभिव्यक्तिमान वॉइस एजेंट के लिए उच्च मात्रा, लागत-कुशल स्केल प्रदान करता है जिसमें स्वर और गति पर बारीक नियंत्रण होता है। ये मॉडल Google के बढ़ते Gemini ऑडियो परिवार को पूरक प्रदान करते हैं और 100+ भाषाओं और व्याकरणों में 2,000+ उत्पादन-तैयार आवाज़ों तक पहुंच प्रदान करते हैं। प्रमुख संबंधित तत्व: कंपनियाँ: Google, Google AI; व्यक्तियाँ: Alan Cowen। अक्सर पूछे जाने वाले प्रश्न: Gemini 3.8 Flash TTS की प्रमुख विशेषताएँ क्या हैं? Gemini 3.8 Flash TTS प्राकृतिक भाषा प्रेरणाओं का उपयोग करके शून्य से अनुकूलित आवाज़ें बनाने की अनुमति देता है, पंक्ति दर पंक्ति सूक्ष्म प्रदर्शन नियंत्रण, 100+ भाषाओं में 2,000+ उत्पादन-तैयार आवाज़ों तक पहुंच, और सहमति सत्यापन के साथ 30-सेकंड ऑडियो नमूनों से आवाज़ प्रतिलिपि बनाने की अनुमति देता है। अक्सर पूछे जाने वाले प्रश्न Q: Gemini 3.8 Flash TTS की प्रमुख विशेषताएँ क्या हैं? अक्सर पूछे जाने वाले उत्तर A: Gemini 3.8 Flash TTS प्राकृतिक भाषा प्रेरणाओं का उपयोग करके शून्य से अनुकूलित आवाज़ें बनाने की अनुमति देता है, पंक्ति दर पंक्ति सूक्ष्म प्रदर्शन नियंत्रण, 100+ भाषाओं में 2,000+ उत्पादन-तैयार आवाज़ों तक पहुंच, और सहमति सत्यापन के साथ 30-सेकंड ऑडियो नमूनों से आवाज़ प्रतिलिपि बनाने की अनुमति देता है।