Prithwish Dan
Cornell University
収録論文 8本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA/解釈可能性VLAsim2real模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- X-Reset: クロスエンボディメント・リセットによる物体中心強化学習のスケーリングマニピュレーション2026/9/28
人間の手と物体のデモンストレーションをロボットのリセット状態に変換し、汎用物体中心報酬での強化学習の探索問題を解決するフレームワークを提案。
- VLA表現からのタスク進捗の解読VLA/解釈可能性2026/8/1
視覚言語行動モデル(VLA)の内部表現からタスクの進捗状況が線形に読み取れることを発見し、それを用いたラベル不要の異常検出器を提案した論文。
- X-Diffusion: 異なる身体性の人間デモンストレーションから拡散ポリシーを学習VLA2025/11/1
人間の動作をノイズの多いロボット動作とみなし、拡散過程の高ノイズ段階でのみ人間デモを学習に使うことで、身体性の違いを吸収しつつタスク意図を活用する手法を提案。実機5タスクで成功率を16%向上。
- X-Sim: 実世界からシミュレーションを経由したロボット操作方策のクロスエンボディメント学習sim2real2025/5/1
人間のRGBD動画からフォトリアルなシミュレーションを再構築し、物体軌道を報酬として強化学習方策を訓練、合成データで拡散方策に蒸留して実世界へ転移する枠組みを提案。ロボット遠隔操作データなしで5タスクで成功率を30%改善。
- 実行ミスマッチ下でのワンショット模倣学習模倣学習2024/9/1
人間とロボットの軌道を系列レベルの最適輸送コストで自動対応付けし、ペアデータなしで長期タスクの模倣を可能にするRHyMEを提案した。
- MOSAIC: 支援・対話型料理のためのモジュール型基盤モデルVLA2024/2/1
複数のロボットが自然言語で人間と対話し、多様な日用品を操作できるよう、基盤モデルと専用モジュールを組み合わせたモジュール型アーキテクチャを提案し、料理支援タスクで評価した。
- InteRACT: Transformer Models for Human Intent Prediction Conditioned on Robot Actions2023/11/1
- ManiCast: Collaborative Manipulation with Cost-Aware Human Forecasting2023/10/1