Akshay L Chandra
収録論文 2本 ・ フィジカルAI/ロボット学習
拡散ポリシー/世界モデル/オフラインRLVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DiWA: 世界モデルによる拡散ポリシーの適応拡散ポリシー/世界モデル/オフラインRL2025/8/1
世界モデルを活用し、拡散ポリシーをオフライン強化学習でファインチューニングするフレームワークDiWAを提案。実環境との相互作用を大幅に削減し、CALVINベンチマークで8タスクの性能を向上させた。
- LUMOS: 世界モデルを用いた言語条件付き模倣学習VLA2025/3/1
学習した世界モデルの潜在空間で長期ロールアウトを練習し、言語指示で操作可能なスキルを実機ロボットにゼロショット転移する模倣学習フレームワーク。