Modelos
Meta lança o Muse Voice Transcribe para ASR em tempo real
A Meta Superintelligence Labs apresentou o Muse Voice Transcribe, seu primeiro modelo de percepção de áudio em tempo real: fala para texto em streaming, diarização de mais de 20 falantes, detecção de fim de fala e atraso adaptativo. Ele foi treinado em mais de 70 idiomas (25 amplamente verificados no lançamento) com troca de idioma dentro da mesma frase, e a Meta diz que ocupa o primeiro lugar em fala para texto em streaming da Artificial Analysis em 1º de setembro. Disponível hoje pela Meta Model API, pelo Meta AI para Mac (segure Fn para ditar) e pelo Muse Code.
Traduzido com ajuda de IA.