Prajwal Koirala
収録論文 7本 ・ フィジカルAI/ロボット学習
群制御オフライン強化学習VLAナビゲーション自動運転レース
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 分散型マルチエージェント衝突回避のための通信条件付き生成ポリシー学習群制御2026/9/13
特権的なオフライン実演からフローマッチングで学習した生成ポリシーにより、エージェントが潜在メッセージを交換して分散的に衝突回避行動を生成する手法を提案。
- VGFM: フローマッチングにおける密な価値誘導による表現力豊かなロボット方策オフライン強化学習2026/9/13
フローマッチング方策の各中間ステップで価値誘導を行い、BPTTや追加損失なしにオフライン強化学習を効率化する手法を提案。
- LCLA: 視覚言語ナビゲーションのための言語条件付き潜在空間アライメントVLA2026/2/1
専門家方策の潜在空間に視覚言語観測を写像するアダプタを学習することで、視覚運動学習を教師あり潜在アライメントに還元し、屋内ナビゲーションで高い汎化性能を実現した研究。
- フロー補完による単一ステップ生成方策:効率的で表現力豊かな方策学習VLA2025/6/1
拡張フローマッチング目的で中間フローから直接補完ベクトルを予測し、1回の推論で多様な行動を生成できる生成方策SSCPを提案。オフライン・オンラインRLで拡散モデルより高速かつ高精度を実現。
- 事前学習済み視覚言語埋め込みだけでロボットナビゲーションは可能か?ナビゲーション2025/6/1
凍結した視覚言語モデルの埋め込みのみを用いて模倣学習でナビゲーションポリシーを訓練し、言語指定目標への到達成功率74%を達成したが、長期計画や空間推論に課題があることを示した。
- オフライン強化学習によるF1tenth自動運転レース自動運転レース2024/8/1
F1tenthレース環境でオンライン学習が失敗するため、専門家のデモデータを用いたオフライン強化学習を適用し、未見シナリオへのゼロショット転移や環境変化への適応を評価した。
- Solving Offline Reinforcement Learning with Decision Tree Regression2024/1/21