Model
Meta luncurkan Muse Voice Transcribe untuk ASR waktu nyata
Meta Superintelligence Labs merilis Muse Voice Transcribe, model persepsi audio waktu nyata pertamanya: ucapan-ke-teks streaming, diarisasi untuk 20+ pembicara, endpointing, dan jeda adaptif. Model ini dilatih pada 70+ bahasa (25 diverifikasi secara ekstensif saat peluncuran) dengan alih bahasa di tengah kalimat, dan Meta menyatakan model ini berada di peringkat pertama STT streaming Artificial Analysis per 1 September. Tersedia hari ini lewat Meta Model API, Meta AI untuk Mac (tahan Fn untuk mendikte), dan Muse Code.
Diterjemahkan dengan bantuan AI.