Dwait Bhatt
収録論文 6本 ・ フィジカルAI/ロボット学習
マニピュレーション強化学習モバイルマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DexFuture: 両手巧緻ツール使用のための階層的未来状態視覚運動ターゲティングマニピュレーション2026/6/1
高次元の手の構成と複雑な手-ツール-物体ダイナミクスを扱う両手巧緻ツール使用タスクにおいて、デモンストレーションや遅い計画に依存せずに未来の参照軌道を生成する階層的システムを提案した。
- PhysGraph: 物理に基づくグラフ変換器ポリシーによる両手巧緻な手-道具-物体操作マニピュレーション2026/3/1
両手による道具操作を、システムを運動学的グラフとして表現し、注意機構に物理的構造事前知識を注入するグラフ変換器ポリシーPhysGraphを提案。パラメータ数を減らしつつ操作精度と成功率を向上させ、未見の形状へのゼロショット転移も示した。
- Rainbow-DemoRL: デモンストレーション強化強化学習の改良を組み合わせる強化学習2026/3/1
オフラインデータを活用したオンライン強化学習のサンプル効率向上手法を3分類し、各手法の組み合わせ効果を実証的に分析した論文。
- 全体像を見る:モバイルマニピュレーション方策学習のための3D潜在マップモバイルマニピュレーション2025/10/1
3D潜在特徴マップ上で直接動作するエンドツーエンドの方策学習手法SBPを提案し、画像のみに頼る方策よりも空間的・時間的推論に優れ、未知シーンでも高い成功率を示した。
- ロボットマニピュレーションのための視覚強化学習における視点の統合と分離マニピュレーション2025/5/1
複数のカメラ視点を効率的に統合しつつ、単一視点特徴で拡張して分離することで、サンプル効率が高くカメラ故障に頑健なマニピュレーション方策を学習するMADアルゴリズムを提案。
- 潜在空間アライメントによる異形態ロボットマニピュレーションスキルの転移マニピュレーション2024/6/1
異なる形態のロボット間で制御方策を転移するため、状態と行動を共通の潜在空間に射影し、敵対的学習とサイクル整合性でターゲットのエンコーダ・デコーダを訓練する手法を提案。sim-to-simおよびsim-to-realで有効性を実証。