NvidiaがオープンウェイトモデルNemotron 3.5 Lightningを公開、秒670トークンの高速推論を実現
NvidiaがオープンウェイトモデルNemotron 3.5 Lightningを公開、秒670トークンの高速推論を実現
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-08-12 |
| 元記事 | The Decoder |
要約
Nvidiaはパラメータ数36億のオープンウェイトモデル「Nemotron 3.5 Lightning」を公開した。最大の特長は推論速度で、秒間約670トークンを達成し、より大規模なモデルと同等の出力品質を維持しながら高スループットを実現している。Nvidiaはモデル単体の知性最大化よりもエッジ・ローカル推論やリアルタイムアプリケーション向けの効率性を優先した設計方針を示した。小型高速モデルの需要が高まるなか、オープンウェイト化により開発者がカスタマイズや商用利用を柔軟に行える点も注目される。Google Gemma、Meta Llama等との競争で、モデルサイズとコスト効率のトレードオフが業界の主要課題になってきている。