Harshit Sikchi
収録論文 15本 ・ フィジカルAI/ロボット学習
強化学習ナビゲーションVLA模倣学習sim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 正則化潜在ダイナミクス予測は行動基盤モデルの強力なベースラインである強化学習2026/3/1
ゼロショット強化学習のための状態特徴学習において、複雑な表現学習目的が本当に必要かを検証し、潜在空間での次状態予測に直交性正則化を加えたシンプルな手法RLDPが、既存の複雑な手法と同等以上の性能を達成することを示した。
- 行動基盤モデルの高速適応強化学習2025/4/1
事前学習済み行動基盤モデルのゼロショット方策を、低次元タスク埋め込み空間での探索によりオンライン数ステップで高速適応させる手法を提案。
- CREStE: インターネット規模の事前知識と反事実ガイダンスによるスケーラブルな地図なしナビゲーションナビゲーション2025/3/1
視覚基盤モデルの蒸留と反事実逆強化学習を組み合わせ、未知の都市・オフロード環境でも長距離を地図なしで走行できるナビゲーション手法を提案。
- RLZero: ドメイン内教師なしで言語から直接方策を推論VLA2024/12/1
言語指示から動画生成モデルで想像した観測を対象環境に投影し、教師なし強化学習で事前学習したエージェントが即座に模倣することで、追加学習なしに言語から行動を生成する手法を提案。
- オフラインデータセットを用いた観察からの模倣学習への双対アプローチ模倣学習2024/6/1
専門家の行動データなしに観察のみから模倣するため、双対性原理に基づく多段効用関数を直接学習するDILOを提案し、高次元観察でも性能を向上させた。
- ロボットエアホッケー:強化学習のためのマニピュレーションテストベッドsim2real2024/5/1
ロボットエアホッケーを題材に、到達からブロック押し出しまで多様なタスクと2つのシミュレータ・実機を含む強化学習テストベッドを構築し、模倣学習・オフラインRL・スクラッチRLで評価した。
- SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning2023/11/1
- Dual RL: Unification and New Methods for Reinforcement and Imitation Learning2023/2/1
- Real Robot Challenge 2021: Cartesian Position Control with Triangle Grasp and Trajectory Interpolation2022/3/1
- A Ranking Game for Imitation Learning2022/2/1
- Real Robot Challenge: A Robotics Competition in the Cloud2021/9/1
- Lyapunov Barrier Policy Optimization2021/3/1
- f-IRL: Inverse Reinforcement Learning via State Marginal Matching2020/11/1
- Learning Off-Policy with Online Planning2020/8/1
- Imitative Planning using Conditional Normalizing Flow2020/7/1