Modelle
Meta startet Muse Voice Transcribe für Echtzeit-Spracherkennung
Meta Superintelligence Labs hat Muse Voice Transcribe veröffentlicht, sein erstes Echtzeit-Audiowahrnehmungsmodell: Streaming-Spracherkennung, Sprechertrennung für mehr als 20 Sprecher, Endpunkterkennung und adaptive Verzögerung. Es ist auf mehr als 70 Sprachen trainiert (25 zum Start umfassend geprüft) und wechselt innerhalb eines Satzes die Sprache; laut Meta liegt es mit Stand 1. September auf Platz eins der Streaming-STT-Wertung von Artificial Analysis. Ab heute verfügbar über die Meta Model API, Meta AI für Mac (zum Diktieren Fn halten) und Muse Code.
Mit KI-Unterstützung übersetzt.