Tech Shots
أخبار الذكاء الاصطناعي والروبوتات
العربية
النماذج

Meta تطلق Muse Voice Transcribe للتعرّف على الكلام في الزمن الحقيقي

أطلقت Meta Superintelligence Labs نموذج Muse Voice Transcribe، وهو أول نموذج لها لإدراك الصوت في الزمن الحقيقي: تحويل الكلام إلى نص بالبث المباشر، وفصل أكثر من 20 متحدثًا، وتحديد نهاية الكلام، وتأخير تكيّفي. دُرِّب النموذج على أكثر من 70 لغة (جرى التحقق الموسّع من 25 منها عند الإطلاق) مع تبديل اللغة داخل الجملة الواحدة، وتقول Meta إنه يحتل المركز الأول في تحويل الكلام إلى نص بالبث لدى Artificial Analysis حتى 1 سبتمبر. وهو متاح اليوم عبر Meta Model API وMeta AI لنظام Mac (اضغط مطوّلًا على Fn للإملاء) وMuse Code.

المصدر: Meta AI Research

تُرجم بمساعدة الذكاء الاصطناعي.