"LeRobot v0.6.0リリース:世界モデルポリシーと報酬モデルでロボット学習を強化"
LeRobot v0.6.0リリース:世界モデルポリシーと報酬モデルでロボット学習を強化
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-07-08 |
| 元記事 | Hugging Face Blog |
要約
ロボット学習は「想像→評価→改善」のループが必要だが、従来システムでは世界モデルや報酬モデルが断片的で実用化のハードルが高かった。v0.6.0ではVLA-JEPAなどの世界モデルポリシー、GR00T N1.7やMolmoAct2を含む新VLA5種、タスク成功を判定する報酬モデル「ロボメーター」、深度センサー対応、VLM駆動の自動注釈パイプラインが追加された。CLIツール「lerobot-rollout」で失敗データを自動収集して継続学習に活用できる仕組みも整備され、研究から本番環境への移行コストが大幅に低減される。