Deepak Pathak
Carnegie Mellon University
収録論文 77本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ParticleSplat: 自己教師ありオブジェクト中心潜在粒子スプラッティング3D表現学習2026/9/16
複数視点の画像から3Dガウシアンスプラッティングを用いてシーンを物体ごとの潜在粒子に分解し、教師なしで物体マスクを獲得しロボット操作タスクの性能を向上させる手法を提案。
- BRIDGE: 形態と制御の共設計による物理AIのためのオープンソース人型ロボットプラットフォーム人型ロボット/共設計2026/9/3
人間の動作データを活用できる人型ロボットの設計を、形態と全身制御をデータ駆動で共最適化するフレームワークを提案し、その設計を実現したオープンソースの小型人型ロボット「Bridge」を公開した。
- FlowDPG: フローマッチングポリシーに対する決定論的ポリシー勾配の実世界操作への応用強化学習/操作2026/6/1
フローマッチングポリシーにDDPGスタイルの強化学習を適用する際、時間方向の逆伝播(BPTT)を回避する蒸留フレームワークを提案し、実世界の長期的な両腕組み立てタスクで92%の成功率を達成した。
- FACTR 2: コモディティロボットアームの外力センシング学習がポリシー学習を向上させる力覚推定/模倣学習2026/6/1
専用の力センサーを持たないロボットアームでも、データ駆動で外力トルクを推定するNEXTと、接触前後のデータを重点的に学習するFIRSTを組み合わせることで、力覚を活用した遠隔操作とポリシー学習を可能にした論文。
- 3D-DLP: 自己教師あり3Dオブジェクト中心シーン表現学習表現学習2026/6/1
RGB-Dやボクセル観測を3D潜在粒子に分解し、解釈可能で制御可能なオブジェクト中心表現を自己教師ありで学習するモデルを提案。ロボット操作タスクでの性能向上も確認。
- 物理シミュレータ上での強化学習による物理オリンピック問題解決物理推論/LLM/強化学習2026/4/1
物理シミュレータでランダムなシーンを生成し、合成の問答データを作ってLLMを強化学習で訓練し、実世界の物理ベンチマーク(IPhOなど)へのゼロショット転移を実証した論文。
- 潜在粒子世界モデル:自己教師ありのオブジェクト中心確率動的モデリング世界モデル2026/3/4
ビデオデータから教師なしでキーポイントやオブジェクトマスクを発見し、確率的な粒子動力学を学習する世界モデルを提案。実世界のマルチオブジェクトデータセットで最先端の性能を達成し、意思決定タスクにも応用可能。
- 反復的な自己修正による構成的画像生成の改善画像生成2026/1/1
視覚言語モデルを批評役として用い、テキスト画像生成モデルが複数ステップで生成を反復的に洗練させる手法を提案し、構成的なプロンプトでの生成精度を向上させた。
- ViPRA: 動画予測によるロボット行動生成VLA2025/11/1
ラベルなし動画から将来の視覚観測と潜在行動を予測するモデルを事前学習し、少数の実演で連続ロボット制御を微調整するフレームワークを提案。
- IFG: インターネット規模の知識を活用した機能的な把持生成マニピュレーション2025/11/1
大規模視覚モデルの意味理解とシミュレーションによる力学的把持生成を組み合わせ、人手データなしで高精度なロボット把持を実現した研究。
- LocoFormer:長文脈適応による汎用歩行制御歩行2025/9/1
大規模強化学習と長い文脈長を組み合わせ、未知の脚式・車輪式ロボットを制御できる汎用歩行モデルを実現した。
- 動的環境における反応的マニピュレータ動作計画のための深層反応ポリシーマニピュレーション2025/9/1
点群入力を直接用いて動的・部分観測環境で衝突回避動作を生成する視覚運動ニューラルポリシーDRPを提案し、シミュレーションと実機で従来手法を上回る成功率を示した。
- マイクロロボット向け高トルク密度PCBアキシャルフラックス永久磁石モータアクチュエータ2025/9/1
IC基板HDI技術で作製した48層PCB巻線により、直径19mm・厚さ5mmで銅充填率45%を達成したマイクロアキシャルフラックスモータを開発し、電磁・熱解析と試作機で性能を検証した。
- データ制約下では拡散モデルが自己回帰モデルを上回る拡散言語モデル2025/7/1
データが乏しく計算資源が豊富な状況でマスク付き拡散言語モデルを系統的に検証し、自己回帰モデルより優れることとその理由(ランダムマスクによる暗黙のデータ拡張)を明らかにした。
- DexWild: 日常環境での人間の手による器用な操作データ収集とロボット方策学習マニピュレーション2025/5/1
低コストなウェアラブルデバイスで人間の手の操作データを収集し、人間とロボットのデモを共訓練することで、未知環境や異なる身体でも汎化する器用な操作方策を実現した。
- 統合マルチモーダル離散拡散モデルマルチモーダル生成2025/3/1
テキストと画像を統一的に理解・生成できる離散拡散モデルUniDiscを提案し、自己回帰型モデルより高性能かつ制御性・編集性・インペインティングに優れることを示した。
- 進化的方策最適化強化学習2025/3/1
進化的アルゴリズムのスケーラビリティと方策勾配の安定性を組み合わせたハイブリッド強化学習手法EPOを提案し、巧みな操作や歩行タスクで性能を向上させた。
- FACTR: 接触の多いタスクのための力覚に注目させるカリキュラム学習マニピュレーション2025/2/1
力覚フィードバックを双方向テレオペで収集し、視覚入力を徐々に劣化させるカリキュラムで力覚に注目させる方策学習手法を提案。未見物体への汎化性能を43%向上させた。
- 複雑タスクのための両手巧み操作システムBidexテレオペレーション2024/11/1
モーションキャプチャグローブとティーチャーアームを用いた低コスト・低遅延の両手巧みテレオペレーションシステムBidexを開発し、複雑タスクで高品質なデータを高速に収集できることを示した。
- 局所ポリシーによるゼロショット長期的マニピュレーションsim2real2024/10/1
ロボットの絶対姿勢や物体配置に依存しない「局所ポリシー」を基盤モデルと組み合わせ、シミュレーションから実機へのゼロショット転移で最大8段階の長期タスクを実現した。
- Neural MP: 汎用ニューラル動作計画器動作計画2024/9/1
シミュレーションで大量の複雑シーンと専門家データを生成し、反応的な汎用方策へ蒸留して軽量最適化と組み合わせることで、実世界の動作計画を高速かつ高成功率で実現した。
- 自律的な実世界強化学習による移動マニピュレーションの継続的改善移動マニピュレーション2024/9/1
人間の監督や大規模な計測装置なしに、実世界で移動マニピュレーション方策を継続的に学習・改善する強化学習フレームワークを提案し、Spotロボットで4つの難タスク平均80%の成功率を達成した。
- 報酬勾配による動画拡散モデルのアラインメント動画生成2024/7/1
事前学習済み報酬モデルから動画拡散モデルへ勾配を逆伝播させ、少ない計算量とサンプルで下流タスクに適応させる手法を提案。
- SAPG:分割統合方策勾配法強化学習2024/7/1
大規模並列環境を分割して重要度サンプリングで統合する新しいオンポリシー強化学習アルゴリズムSAPGを提案し、PPOを上回る性能を実現した。
- Meta-Evolve: 連続的ロボット進化による1対多ポリシー転移sim2real2024/5/1
木構造のロボット進化系列を通じて、1つの熟練ポリシーを複数の異なるロボットへ効率的に転移する手法を提案し、マニピュレーションと歩行タスクで大幅な効率改善を実証した。
- SPIN: 知覚・インタラクション・ナビゲーションの同時実行移動マニピュレーション2024/5/1
移動マニピュレータが能動的な視覚システムを用いて、移動しながら知覚し環境と相互作用する反応型フレームワークを提案。
- Adaptive Mobile Manipulation for Articulated Objects In the Open World2024/1/1
- PlayFusion: Skill Acquisition via Diffusion from Language-Annotated Play2023/12/1
- Dexterous Functional Grasping2023/12/1
- Diffusion-TTA: Test-time Adaptation of Discriminative Models via Generative Feedback2023/11/1
- DEFT: Dexterous Fine-Tuning for Real-World Hand Policies2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Aligning Text-to-Image Diffusion Models with Reward Backpropagation2023/10/1
- Efficient RL via Disentangled Environment and Agent Representations2023/9/1
- Extreme Parkour with Legged Robots2023/9/1
- LEAP Hand: Low-Cost, Efficient, and Anthropomorphic Hand for Robot Learning2023/9/1
- Structured World Models from Human Videos2023/8/1
- Designing Anthropomorphic Soft Hands through Interaction2023/6/1
- Affordances from Human Videos as a Versatile Representation for Robotics2023/4/1
- Your Diffusion Model is Secretly a Zero-Shot Classifier2023/3/1
- Legs as Manipulator: Pushing Quadrupedal Agility Beyond Locomotion2023/3/1
- Internet Explorer: Targeted Representation Learning on the Open Web2023/2/1
- ALAN: Autonomously Exploring Robotic Agents in the Real World2023/2/1
- VideoDex: Learning Dexterity from Internet Videos2022/12/1
- HERD: Continuous Human-to-Robot Evolution for Learning from Human Demonstration2022/12/1
- Legged Locomotion in Challenging Terrains using Egocentric Vision2022/11/1
- Deep Whole-Body Control: Learning a Unified Policy for Manipulation and Locomotion2022/10/1
- Understanding Collapse in Non-Contrastive Siamese Representation Learning2022/9/1
- Human-to-Robot Imitation in the Wild2022/7/1
- Adapting Rapid Motor Adaptation for Bipedal Robots2022/5/1
- Test-time Adaptation with Slot-Centric Models2022/3/1
- RB2: Robotic Manipulation Benchmarking with a Twist2022/3/1
- Robotic Telekinesis: Learning a Robotic Hand Imitator by Watching Humans on Youtube2022/2/1
- REvolveR: Continuous Evolutionary Models for Robot-to-robot Policy Transfer2022/2/1
- Language Models as Zero-Shot Planners: Extracting Actionable Knowledge for Embodied Agents2022/1/1
- Functional Regularization for Reinforcement Learning via Learned Fourier Features2021/12/1
- Coupling Vision and Proprioception for Navigation of Legged Robots2021/12/1
- Differentiable Spatial Planning using Transformers2021/12/1
- Minimizing Energy Consumption Leads to the Emergence of Gaits in Legged Robots2021/11/1
- Generalization in Dexterous Manipulation via Geometry-Aware Multi-Task Learning2021/11/1
- Discovering and Achieving Goals via World Models2021/10/1
- Accelerating Robotic Reinforcement Learning via Parameterized Action Primitives2021/10/1
- RMA: Rapid Motor Adaptation for Legged Robots2021/7/1
- Hierarchical Neural Dynamic Policies2021/7/1
- Unsupervised Learning of Visual 3D Keypoints for Control2021/6/1
- Auto-Tuned Sim-to-Real Transfer2021/4/1
- Neural Dynamic Policies for End-to-End Sensorimotor Learning2020/12/1
- Planning in Learned Latent Action Spaces for Generalizable Legged Locomotion2020/8/1
- Planning to Explore via Self-Supervised World Models2020/5/1
- Sparse Graphical Memory for Robust Planning2020/3/1
- Third-Person Visual Imitation Learning via Decoupled Hierarchical Controller2019/11/1
- Self-Supervised Exploration via Disagreement2019/6/1
- Learning to Control Self-Assembling Morphologies: A Study of Generalization via Modularity2019/2/1
- Large-Scale Study of Curiosity-Driven Learning2018/8/1
- Learning Instance Segmentation by Interaction2018/6/1
- Zero-Shot Visual Imitation2018/4/1
- Curiosity-driven Exploration by Self-supervised Prediction2017/5/1