HeadlinesBriefing favicon HeadlinesBriefing.com

Meta lanza Muse Voice Transcribe: transcripción de audio en tiempo real para Mac

9to5Mac •
×

Meta está lanzando Muse Voice Transcribe, su primer modelo de percepción de audio en tiempo real. Aporta transcripción multilingüe en streaming a Meta AI para Mac, Muse Code y a los desarrolladores a través de la API de Meta Model.

Muse Voice Transcribe impulsa el dictado a nivel de sistema en Mac. Meta Superintelligence Labs dice que Muse Voice Transcribe combina el reconocimiento automático de voz en streaming con diarización de hablantes y detección de final de locución. En términos prácticos, puede transcribir el habla a medida que ocurre, separar hablantes en grabaciones con más de 20 voces y determinar cuándo alguien ha terminado de hablar, todo sin un paso de posprocesamiento separado.

El modelo fue entrenado en más de 70 idiomas, con 25 validados en el lanzamiento. Admite audio de más de una hora, además de cambio de código nativo dentro o entre oraciones. En lugar de usar una compensación fija entre velocidad y precisión, Muse Voice Transcribe decide cuánto tiempo escuchar antes de comprometerse con cada palabra. Meta llama a esto "retraso adaptativo". Meta dice que el modelo ocupa el primer lugar en la clasificación de reconocimiento de voz en streaming de Artificial Analysis a partir del 1 de septiembre.

Muse Voice Transcribe está disponible hoy a través de la API de Meta Model por $3 por cada 1.000 minutos de audio, equivalente a $0,18 por hora. También ya impulsa el dictado en Meta AI para Mac y Muse Code. En Mac, los usuarios pueden mantener presionada la tecla Fn para dictar en cualquier aplicación.

Entidades clave: Empresas: Meta | Personas: Spencer Barnett

Preguntas frecuentes: ¿Qué es Muse Voice Transcribe?

Muse Voice Transcribe es el primer modelo de percepción de audio en tiempo real de Meta para transcripción multilingüe en streaming.