Tech Shots
KI- und Robotik-News
Deutsch
Modelle

Meta startet Muse Voice Transcribe für Echtzeit-Spracherkennung

Meta Superintelligence Labs hat Muse Voice Transcribe veröffentlicht, sein erstes Echtzeit-Audiowahrnehmungsmodell: Streaming-Spracherkennung, Sprechertrennung für mehr als 20 Sprecher, Endpunkterkennung und adaptive Verzögerung. Es ist auf mehr als 70 Sprachen trainiert (25 zum Start umfassend geprüft) und wechselt innerhalb eines Satzes die Sprache; laut Meta liegt es mit Stand 1. September auf Platz eins der Streaming-STT-Wertung von Artificial Analysis. Ab heute verfügbar über die Meta Model API, Meta AI für Mac (zum Diktieren Fn halten) und Muse Code.

Quelle: Meta AI Research

Mit KI-Unterstützung übersetzt.