Microsoft Research「Lens」——高品質キャプション8億件で大型モデルに匹敵
Microsoft Research「Lens」——高品質キャプション8億件で大型モデルに匹敵
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-06-09 |
| 元記事 | The Decoder |
要約
Microsoft Researchは38億パラメータのテキスト→画像生成モデル「Lens」を発表した。GPT-4.1で生成した8億件の高品質キャプションを学習データとして使用することで、はるかに大きなモデルに匹敵するベンチマーク性能を達成し、学習コストは大幅に削減できたという。従来の「大規模な汎用Webデータ」に依存する学習パラダイムに対し、「少量でも高品質なキャプション」が学習効率を根本的に向上させることを実証した。データ品質がパラメータ数・データ量のスケールを上回るという知見は、画像生成以外のモダリティにも広く応用できると期待されており、コスト効率を重視するAI開発戦略に転換点をもたらす可能性がある。