My News ← 戻る

Nvidiaが最大8話者をリアルタイム識別できる1億パラメータの話者分離モデルを無償公開

Nvidiaが最大8話者をリアルタイム識別できる1億パラメータの話者分離モデルを無償公開

項目 内容
ジャンル AI
日付 2026-09-28
元記事 The Decoder

要約

NvidiaはNemotron 3 Diarizationと呼ばれる1億パラメータの話者分離(diarization)モデルを無償公開した。最大8話者をリアルタイムで識別でき、会議の書き起こし・マルチ話者コンテンツの分析・コールセンター業務など幅広い用途に活用できる。大規模モデルの開発と同時に実用的な小型モデルのオープン公開を進めるNvidiaの戦略の一環として注目される。音声AI分野の民主化が加速する中、商用ライセンスなしで本番環境に導入できる点がエンジニアや企業ユーザーに歓迎されている。


元記事を読む →