Homanga Bharadhwaj
Johns Hopkins University
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 観察・推論・協調:ゼロショット協調のためのロボットパートナーの制約推論協調マニピュレーション2026/10/1
ロボットが別のロボットの物理的制約を共同行動から推論し、新しいタスクでゼロショット協調を実現するベンチマークと手法を提案。
- 日常動画から関節物体を再構成し操作を再現する実-to-シミュレーション手法sim2real2026/9/16
単眼RGB動画から、ドアや引き出しなどの関節物体のリンク分割・関節推定・3D再構成を行い、手の動きと合わせてシミュレーション上で操作を再現するフレームワークを提案。
- モーション・フォアサイト:将来の3Dシーンフロー予測のためのビデオモデルの再利用動作予測2026/7/17
人間と物体のインタラクションを含む単眼ビデオから、操作される物体上の点の将来の3D軌跡を予測する手法を提案。事前学習済みビデオモデルの知識を活用し、軽量なアダプタで将来予測を行う。
- 仮想人間デモからソフトロボットポリシーへの機能的な力認識リターゲティングソフトロボティクス/リターゲティング2026/4/1
ソフトロボットハンドに人間の操作スキルを教えるため、接触力を明示的に考慮した2段階の力認識リターゲティング手法を提案し、実世界での成功率を向上させた。
- LiLo-VLA: 物体中心ポリシー連携による長期的マニピュレーションの構成VLA2026/2/1
物体中心のVLAポリシーをモジュール化して連結し、未学習の長期的マニピュレーション課題にゼロショットで汎化するフレームワークを提案。
- RGB人間動画からの3D手-物体軌道再構成による巧みな操作ポリシーマニピュレーション2026/2/1
単眼RGB動画から人間の手と物体の3D軌道を再構成し、ロボットハンドへ転移することで、特別な装置なしに巧みな操作ポリシーを学習するフレームワークを提案。
- 推論から動作へ流れる:一人称視点の人間インタラクション動画から3D手軌道予測を学習手軌道予測2025/12/1
一人称視点のインタラクション動画を用いて、視覚言語推論と動作生成を軌道トークンで結びつけ、段階を考慮した3D手軌道を予測するフレームワークを提案。大規模データセットEgoMANも構築。
- SPIDER: スケーラブルな物理情報に基づく巧みなリターゲティングリターゲティング2025/11/1
人間の運動データを物理シミュレーションでロボットの動的に実行可能な軌道に変換し、大規模な巧みな操作ポリシー学習を可能にするフレームワークを提案。
- スマートレンズから器用さを獲得:日常環境での人間デモによる多指ロボットマニピュレーションマニピュレーション2025/11/1
Aria Gen 2グラスで日常環境の人間の手の動きを収集し、ロボットデータなしで多指ハンドの3D点ベース方策を学習するフレームワークAINAを提案。
- DemoDiffusion:事前学習済み拡散ポリシーを用いた一回の人間模倣模倣学習2025/6/1
人間の実演を一回だけ模倣してロボットに操作タスクを実行させる手法。運動学的リターゲティングで得た粗い軌道を、事前学習済みの汎用拡散ポリシーで修正することで、タスク固有の訓練や人間-ロボットのペアデータなしに新しいタスクやシーンに適応できる。
- Web2Grasp: ウェブ画像の手と物体のインタラクションから機能的な把持を学習マニピュレーション2025/5/1
ウェブ画像から人間の手と物体の3Dインタラクションを復元し、ノイズ除去と物理シミュレーションを経て、多指ロボットハンドの機能的な把持を学習する手法を提案。
- 意味的に制御可能な拡張による汎化可能なロボット学習sim2real2024/9/1
画像テキスト生成モデルをデータ拡張に活用し、ロボット操作データを多様化することで、未見の実環境への汎化を可能にする学習フレームワークを提案した。
- Gen2Act: 人間動画生成を活用した汎用ロボットマニピュレーションマニピュレーション2024/9/1
ウェブデータで学習した人間動画生成モデルを使い、生成された動画を条件にロボット方策を学習することで、未見物体や新規動作への汎化を実現した。
- Track2Act: インターネット動画からの点トラック予測による汎化可能なロボットマニピュレーションマニピュレーション2024/5/1
ウェブ上の人間やロボットの動画から画像内の点の動きを予測し、それを物体の剛体変換に変換してロボットの手先軌道を生成することで、未見の物体や場面でも適応なしに操作できる汎用的なマニピュレーション手法を提案した。
- Towards Generalizable Zero-Shot Manipulation via Translating Human Interaction Plans2023/12/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- RoboAgent: Generalization and Efficiency in Robot Manipulation via Semantic Augmentations and Action Chunking2023/9/1
- Visual Affordance Prediction for Guiding Robot Exploration2023/5/1
- Zero-Shot Robot Manipulation from Passive Human Videos2023/2/1
- CACTI: A Framework for Scalable Multi-Task Multi-Scene Visual Imitation Learning2022/12/1
- Simplifying Model-based RL: Learning Representations, Latent-space Models, and Policies with One Objective2022/9/1
- INFOrmation Prioritization through EmPOWERment in Visual Model-Based RL2022/4/1
- Auditing Robot Learning for Safety and Compliance during Deployment2021/10/1
- Learning by Watching: Physical Imitation of Manipulation Skills from Human Videos2021/1/1
- Latent Skill Planning for Exploration and Transfer2020/11/1
- Conservative Safety Critics for Exploration2020/10/1
- Continual Model-Based Reinforcement Learning with Hypernetworks2020/9/1
- LEAF: Latent Exploration Along the Frontier2020/5/1
- Model-Predictive Control via Cross-Entropy and Gradient-Based Optimization2020/4/1
- MANGA: Method Agnostic Neural-policy Generalization and Adaptation2019/11/1
- A Data-Efficient Framework for Training and Sim-to-Real Transfer of Navigation Policies2018/10/1