Modelli
Meta lancia Muse Voice Transcribe per il riconoscimento vocale in tempo reale
Meta Superintelligence Labs ha lanciato Muse Voice Transcribe, il suo primo modello di percezione audio in tempo reale: speech-to-text in streaming, diarizzazione di oltre 20 parlanti, rilevamento della fine del parlato e ritardo adattivo. È addestrato su oltre 70 lingue (25 verificate ampiamente al lancio) con cambio di lingua all'interno della stessa frase, e Meta afferma che è primo nella classifica STT in streaming di Artificial Analysis al 1° settembre. Disponibile da oggi tramite la Meta Model API, Meta AI per Mac (tieni premuto Fn per dettare) e Muse Code.
Tradotto con l'aiuto dell'IA.