モデル
Microsoft AI、音声認識モデル「MAI-Transcribe-2」を公開
Microsoft AIは2026年9月3日、MAI-Transcribe-2がMicrosoft Foundry、MAI Playground、Open Routerでデモ利用できると発表した。同社によると、このモデルは話者分離、単語レベルのタイムスタンプ、キーワードバイアス、逐語・整文スタイル、コードスイッチングに対応した。FLEURSの60言語で1位(平均WER 5.2%)、Artificial Analysisの精度とレイテンシのパレートフロンティアに入っていると主張しているが、これらの順位は投稿時点のMicrosoftによる引用である。ローンチ価格は年末まで音声1時間あたり0.10ドル。
AIの支援により翻訳しました。