Meta lance Muse Voice Transcribe pour la reconnaissance vocale en temps réel
Meta Superintelligence Labs a lancé Muse Voice Transcribe, son premier modèle de perception audio en temps réel : synthèse vocale vers texte en streaming, diarisation de plus de 20 locuteurs, détection de fin de phrase et délai adaptatif. Il est entraîné sur plus de 70 langues (25 largement vérifiées au lancement), avec alternance de langues au sein d'une même phrase, et Meta affirme qu'il se classe premier sur la reconnaissance vocale en streaming d'Artificial Analysis au 1er septembre. Disponible dès aujourd'hui via la Meta Model API, Meta AI pour Mac (maintenir Fn pour dicter) et Muse Code.
Traduit avec l'aide de l'IA.