Rohan Baijal
収録論文 10本 ・ フィジカルAI/ロボット学習
逆強化学習ナビゲーション模倣学習/オフライン強化学習経路計画マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オンライン世界モデリングによる観察からの実世界逆強化学習逆強化学習2026/2/1
オンライン世界モデルを用いて、実世界のロボットが観察(動画)のみから視覚的マニピュレーションを逆強化学習で学習する手法を提案し、ピックアンドプレースを40分未満で82%の成功率まで達成した。
- VAMOS:能力に応じて調整可能な階層型視覚-言語-行動モデルによる誘導可能なナビゲーションナビゲーション2025/10/1
意味的計画と身体性の接地を分離した階層型VLAを提案し、車輪・脚型ロボット間のクロス身体性ナビゲーションと自然言語による誘導を実現した。
- 非専門家データを活用したオフライン強化学習による模倣学習のロバスト化模倣学習/オフライン強化学習2025/10/1
非専門家データ(プレイデータや不完全なデモ)をオフライン強化学習で活用し、模倣学習ポリシーの回復性と汎化性能を高める手法を提案。
- 長距離ナビゲータ(LRN):メトリックマップを超えてロボットの計画視野を拡張ナビゲーション2025/4/1
カメラ画像から「進めるフロンティア」を学習し、屋外ナビゲーションの計画視野を拡張する手法を提案。ラベルなし動画で学習でき、既存スタックに組み込むと人的介入と意思決定時間を削減。
- 不確実な環境認識下でのオフロード自律走行のためのマルチサンプル長距離経路計画経路計画2024/3/1
不確実な観測のもとでオフロード車両が長距離経路を動的に再計画する手法DREAMSを提案し、DARPA RACERの実データで従来の決定化手法より走行時間と衝突コストの両面で優れることを示した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- SoRTS: Learned Tree Search for Long Horizon Social Robot Navigation2023/9/1
- Learned Tree Search for Long-Horizon Social Robot Navigation in Shared Airspace2023/4/1
- Challenges in Close-Proximity Safe and Seamless Operation of Manned and Unmanned Aircraft in Shared Airspace2022/11/1