Nvidiaが最大8話者をリアルタイム識別できる1億パラメータの話者分離モデルを無償公開
Nvidiaが最大8話者をリアルタイム識別できる1億パラメータの話者分離モデルを無償公開
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-09-28 |
| 元記事 | The Decoder |
要約
NvidiaはNemotron 3 Diarizationと呼ばれる1億パラメータの話者分離(diarization)モデルを無償公開した。最大8話者をリアルタイムで識別でき、会議の書き起こし・マルチ話者コンテンツの分析・コールセンター業務など幅広い用途に活用できる。大規模モデルの開発と同時に実用的な小型モデルのオープン公開を進めるNvidiaの戦略の一環として注目される。音声AI分野の民主化が加速する中、商用ライセンスなしで本番環境に導入できる点がエンジニアや企業ユーザーに歓迎されている。