Yash Jangir
Carnegie Mellon University
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA動作予測マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 再構成の迷子:視覚-言語-行動モデルにおける行動表現と言語の整合VLA2026/8/1
行動軌跡には言語的意味情報が含まれるが、再構成のみのトークン化で失われるため、凍結VLMで指示を復元する補助損失を加えた意味整合トークナイザSALTを提案し、SimplerEnvで成功率を大幅に向上させた。
- モーション・フォアサイト:将来の3Dシーンフロー予測のためのビデオモデルの再利用動作予測2026/7/17
人間と物体のインタラクションを含む単眼ビデオから、操作される物体上の点の将来の3D軌跡を予測する手法を提案。事前学習済みビデオモデルの知識を活用し、軽量なアダプタで将来予測を行う。
- RGB人間動画からの3D手-物体軌道再構成による巧みな操作ポリシーマニピュレーション2026/2/1
単眼RGB動画から人間の手と物体の3D軌道を再構成し、ロボットハンドへ転移することで、特別な装置なしに巧みな操作ポリシーを学習するフレームワークを提案。
- RobotArena ∞: 実機からシミュレーションへの変換によるスケーラブルなロボットベンチマークVLA2025/10/1
実機の動画デモを生成モデルでシミュレーション環境に自動変換し、VLAポリシーを大規模かつ再現可能に評価するベンチマークフレームワークを提案。
- Image-based Visual Servo Control for Aerial Manipulation Using a Fully-Actuated UAV2023/6/1
- A Generalized Kalman Filter Augmented Deep-Learning based Approach for Autonomous Landing in MAVs2021/9/1