HeadlinesBriefing favicon HeadlinesBriefing.com

Meta का Muse Voice Transcribe: Mac के लिए रीयल-टाइम ऑडियो ट्रांसक्रिप्शन

9to5Mac •
×

Meta अपना पहला रीयल-टाइम ऑडियो परसेप्शन मॉडल Muse Voice Transcribe लॉन्च कर रहा है। यह Mac के लिए Meta AI, Muse Code और Meta Model API के माध्यम से डेवलपर्स के लिए बहुभाषी, स्ट्रीमिंग ट्रांसक्रिप्शन लाता है।

Muse Voice Transcribe Mac पर सिस्टम-व्यापी डिक्टेशन को सशक्त बनाता है। Meta Superintelligence Labs का कहना है कि Muse Voice Transcribe स्ट्रीमिंग स्वचालित भाषण पहचान को स्पीकर पृथक्करण और एंडपॉइंटिंग के साथ जोड़ता है। व्यावहारिक रूप से, यह बोले जाने पर भाषण को ट्रांसक्राइब कर सकता है, 20+ आवाज़ों वाली रिकॉर्डिंग में स्पीकर को अलग कर सकता है, और यह निर्धारित कर सकता है कि कोई व्यक्ति कब बोलना समाप्त कर चुका है, बिना किसी अलग पोस्ट-प्रोसेसिंग चरण के।

मॉडल को 70 से अधिक भाषाओं में प्रशिक्षित किया गया था, जिनमें से 25 को लॉन्च के समय मान्य किया गया था। यह एक घंटे से अधिक के ऑडियो के साथ-साथ वाक्यों के भीतर या बीच में मूल कोड-स्विचिंग का समर्थन करता है। प्रत्येक शब्द को प्रतिबद्ध करने से पहले कितनी देर तक सुनना है, यह तय करने के लिए Muse Voice Transcribe गति और सटीकता के बीच किसी निश्चित समझौते का उपयोग करने के बजाय, यह तय करता है। Meta इसे "अनुकूली विलंब" कहता है। Meta का कहना है कि 1 सितंबर तक यह मॉडल आर्टिफिशियल एनालिसिस स्ट्रीमिंग स्पीच-टू-टेक्स्ट लीडरबोर्ड पर पहले स्थान पर है।

Muse Voice Transcribe आज Meta Model API के माध्यम से प्रति 1,000 ऑडियो-मिनट पर $3 में उपलब्ध है, जो $0.18 प्रति घंटे के बराबर है। यह पहले से ही Mac के लिए Meta AI और Muse Code में डिक्टेशन को सशक्त बना रहा है। Mac पर, उपयोगकर्ता किसी भी एप्लिकेशन में डिक्टेट करने के लिए Fn कुंजी दबाए रख सकते हैं।

मुख्य संस्थाएँ: कंपनियाँ: Meta | लोग: Spencer Barnett

अक्सर पूछे जाने वाले प्रश्न: Muse Voice Transcribe क्या है?

Muse Voice Transcribe स्ट्रीमिंग, बहुभाषी ट्रांसक्रिप्शन के लिए Meta का पहला रीयल-टाइम ऑडियो परसेप्शन मॉडल है।