Microsoft、音声認識AIモデル「MAI-Transcribe-2」を発表——精度と多言語対応を強化
Microsoft、音声認識AIモデル「MAI-Transcribe-2」を発表——精度と多言語対応を強化
| 項目 | 内容 |
|---|---|
| ジャンル | その他IT |
| 日付 | 2026-09-08 |
| 元記事 | 窓の杜 |
要約
Microsoftが新世代の音声認識AIモデル「MAI-Transcribe-2」を発表した。前世代からの認識精度向上と多言語対応の拡充が図られており、専門用語や方言を含む音声でも高い精度を実現するとされる。クラウドサービスとしてAzure上で提供される予定で、企業向けの文字起こし・会議録自動生成・字幕生成などのユースケースへの活用が期待される。OpenAIのWhisperシリーズと競合する位置付けであり、エンタープライズ向け音声認識市場での競争が一層激化する見通し。日本語認識性能の改善度合いも国内ユーザーの関心を集めており、テレワーク・コールセンター・メディア分野での実用化が進むと見られる。