Modelos
Meta lanza Muse Voice Transcribe para ASR en tiempo real
Meta Superintelligence Labs presentó Muse Voice Transcribe, su primer modelo de percepción de audio en tiempo real: voz a texto en streaming, diarización de más de 20 hablantes, detección de fin de frase y retardo adaptativo. Está entrenado en más de 70 idiomas (25 verificados a fondo en el lanzamiento) con cambio de idioma dentro de una misma oración, y Meta afirma que ocupa el primer lugar en voz a texto en streaming de Artificial Analysis al 1 de septiembre. Disponible hoy mediante la Meta Model API, Meta AI para Mac (mantén Fn para dictar) y Muse Code.
Traducido con ayuda de IA.