Meta выпускает Muse Voice Transcribe для распознавания речи в реальном времени
Meta Superintelligence Labs выпустила Muse Voice Transcribe — свою первую модель восприятия аудио в реальном времени: потоковое преобразование речи в текст, диаризация более чем 20 говорящих, определение конца реплики и адаптивная задержка. Модель обучена более чем на 70 языках (25 из них тщательно проверены к запуску) и умеет переключать язык внутри предложения; по данным Meta, на 1 сентября она занимает первое место в рейтинге потокового распознавания речи Artificial Analysis. Доступна уже сегодня через Meta Model API, Meta AI для Mac (для диктовки удерживайте Fn) и Muse Code.
Переведено с помощью ИИ.