"DSpark:DeepSeekと北京大学が投機的デコーディングフレームワークをオープンソース公開——推論速度最大85%向上"
DSpark:DeepSeekと北京大学が投機的デコーディングフレームワークをオープンソース公開——推論速度最大85%向上
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-06-29 |
| 元記事 | Zenn |
要約
DeepSeekと北京大学の共同研究チームが、LLMの推論高速化を実現する投機的デコーディング(Speculative Decoding)フレームワーク「DSpark」をオープンソースとして公開した。投機的デコーディングとは小型のドラフトモデルが複数トークンを先読みして候補を生成し、大型のターゲットモデルがそれを検証・採用する手法で、スループット(処理速度)を維持したまま生成速度を最大85%向上させることが可能だという。DeepSeekブランドの研究成果が継続的にオープンソースで公開されており、LLM推論インフラのコスト削減に貢献する重要な技術として注目を集めている。