Tech Shots
AIとロボティクスのニュース
日本語
モデル

Meta、リアルタイム音声認識「Muse Voice Transcribe」を公開

Meta Superintelligence Labsは、同社初のリアルタイム音声知覚モデル「Muse Voice Transcribe」を公開した。ストリーミング音声テキスト化、20人以上の話者分離、発話終端検出、適応的な遅延調整を備える。70以上の言語で学習し(公開時に25言語を重点的に検証)、文中での言語切り替えにも対応する。Metaは、9月1日時点でArtificial Analysisのストリーミング音声認識で1位だとしている。本日からMeta Model API、Mac版Meta AI(Fnキーを押し続けて音声入力)、Muse Codeで利用できる。

出典: Meta AI Research

AIの支援により翻訳しました。