David Held
Carnegie Mellon University
収録論文 85本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 行動結果フィードバックによるテスト時方策適応フレームワークSCOUTsim2real2026/9/28
行動予測方策と順ダイナミクスモデルを共有信念潜在空間で結合し、行動と結果の不一致から環境ダイナミクスをオンラインで推定・適応するメタ学習手法を提案。シミュレーションと実機で適応速度とsim-to-real転移の堅牢性を示した。
- 視点一般化可能な視覚模倣学習ポリシーに何が重要か:実証研究模倣学習2026/9/26
視覚模倣学習において、密な視覚トークンの保持と幾何学的推論を行う行動ヘッドが視点一般化に有効であることを実験的に示し、シミュレーションから実世界へのゼロショット転移も実現した。
- H2RBench:人間からロボットへの転移を評価するReal-to-Simベンチマークsim2real2026/9/21
人間の動画デモからロボット操作を学習するH2R転移手法を公平に比較するため、実人間動画とシミュレーションロボット実演に基づく標準ベンチマークを構築し、複数手法の性能を体系的に評価した。
- JAMB:両手操作のための動作と運動の同時拡散マニピュレーション2026/9/21
両手の動作と将来の3D点追跡を共有Transformer内で同時にノイズ除去し、相互に情報を活用して両手操作の精度と汎化性能を高める拡散ポリシーを提案。
- ParticleSplat: 自己教師ありオブジェクト中心潜在粒子スプラッティング3D表現学習2026/9/16
複数視点の画像から3Dガウシアンスプラッティングを用いてシーンを物体ごとの潜在粒子に分解し、教師なしで物体マスクを獲得しロボット操作タスクの性能を向上させる手法を提案。
- GHOST: ロボット操作の汎化を実現する階層的サブゴールポリシーマニピュレーション2026/6/8
多視点RGB-D観測から3Dエンドエフェクタのポーズを予測する高レベルポリシーと、その目標を達成する低レベルコントローラを組み合わせた階層的枠組みを提案し、操作タスクの汎化性能を向上させた。
- 把持から巧みな操作へ:巧みな操作のための大規模把持事前学習巧みな操作2026/6/1
大規模な巧みな把持データセットを利用して低レベル制御器を事前学習し、関節式ツール使用などの機能的な巧みな操作タスクで性能を向上させる手法を提案した。
- 3D-DLP: 自己教師あり3Dオブジェクト中心シーン表現学習表現学習2026/6/1
RGB-Dやボクセル観測を3D潜在粒子に分解し、解釈可能で制御可能なオブジェクト中心表現を自己教師ありで学習するモデルを提案。ロボット操作タスクでの性能向上も確認。
- RoboWits: ロボットの創造的問題解決における予期せぬ課題ベンチマーク2026/5/1
ロボットの認知推論と創造的ツール使用を評価するためのバイマニピュレータベンチマークを提案し、自動タスク生成パイプラインを用いて多様なタスクを作成。既存のVLAが変異タスクで性能が低下することを示した。
- 精密な物体配置のための分離点拡散マニピュレーション2026/4/1
物体配置タスクを階層的かつ分離された点拡散フレームワークでモデル化し、配置精度と汎化性能を向上させた。
- 潜在粒子世界モデル:自己教師ありのオブジェクト中心確率動的モデリング世界モデル2026/3/4
ビデオデータから教師なしでキーポイントやオブジェクトマスクを発見し、確率的な粒子動力学を学習する世界モデルを提案。実世界のマルチオブジェクトデータセットで最先端の性能を達成し、意思決定タスクにも応用可能。
- 力変調視覚ポリシーによる腕の動きに適応したロボット支援着衣マニピュレーション2025/9/1
視覚と力覚のマルチモーダルフィードバックを用いて、腕の動きに適応しながら長袖衣類を着せるロボット支援着衣システムを開発し、実世界の被験者実験で有効性を示した。
- 点群からの連続行動計画による複数物体再配置マニピュレーション2025/9/1
点群の変換を探索することで、連続行動空間での長期的な物体再配置計画を学習と探索のハイブリッドで実現するSPOTを提案。
- ロボットマニピュレーションのための幾何学的レッドチーミングマニピュレーション2025/9/1
物体形状を自動変形させてマニピュレーション方策の脆弱性を暴くレッドチーミング手法を提案し、発見した形状での微調整により成功率を最大60ポイント改善できることを示した。
- 過去の相互作用を活用する履歴認識型検証器HAVEマニピュレーション2025/9/1
ロボットが曖昧な物体を操作する際、過去の相互作用履歴を推論して候補行動を検証・選択する手法を提案し、実環境で有効性を示した。
- ArticuBot: 大規模シミュレーションによる汎用関節物体操作ポリシーの学習sim2real2025/3/1
物理シミュレーションで大量のデモを生成し、点群ベースの階層的模倣学習ポリシーを訓練することで、未知の関節物体を実機でゼロショット操作できるようにした研究。
- 視覚言語モデルのフィードバックによる実世界オフライン強化学習オフライン強化学習2024/11/1
視覚言語モデルからの選好フィードバックとタスクのテキスト記述を用いてオフラインデータセットに自動で報酬ラベルを付与し、実世界のロボット支援着衣タスクなどで有効な方策を学習するシステムを提案した。
- FlowBotHD: 視覚的曖昧さを伴う関節物体操作のための履歴考慮型拡散モデルマニピュレーション2024/10/1
対称なドアや遮蔽された関節物体の操作において、関節モードの曖昧さを解消するため、観測履歴を活用した拡散ネットワークを提案し、最先端性能を達成した。
- 脚による視覚マニピュレーションマニピュレーション2024/10/1
四足ロボットが脚を使って物体を操作できるシステムを開発し、強化学習による視覚操作方策と歩行・操作コントローラを組み合わせて、シミュレーションと実機で物体の姿勢合わせを実現した。
- 3D密拡散による非剛体の相対配置変形物体マニピュレーション2024/10/1
変形物体同士の相対的な配置関係を「cross-displacement」として定式化し、密拡散モデルで学習する視覚ベースの手法を提案した。
- SplatSim: ガウススプラッティングによるRGBマニピュレーションポリシーのゼロショットSim2Real転移sim2real2024/9/1
シミュレータの描画にガウススプラッティングを採用し、フォトリアルな合成データでRGBベースのマニピュレーションポリシーを学習、実機へゼロショットで転移させて平均86.25%の成功率を達成した。
- HACMan++: 空間的に接地された運動プリミティブによるマニピュレーションマニピュレーション2024/7/1
把持や押しなどの運動プリミティブを「種類・接地位置・実行パラメータ」で表現し、強化学習で組み合わせて長期的な操作タスクを達成する手法を提案。形状や姿勢の変化に汎化し、sim-to-real転移も実現した。
- 布マニピュレーション研究の展開:レビュー布マニピュレーション2024/7/1
布や衣類のロボット操作に関する研究を、モデリング・知覚・ベンチマーク・操作の観点から整理し、布の多様性への対応度を分析して今後の課題を示したレビュー論文。
- タスク固有のクロスポーズ推定のための分布デモンストレーション空間の学習マニピュレーション2024/5/1
少数のマルチモーダルなデモンストレーションから、物体間の相対配置タスクを学習する手法を提案。従来の関係推論ネットワークに追加の特性を組み込み、翻訳不変性と関係性を保ちつつマルチモーダルな解を表現可能にした。
- 精密配置タスクのための深層SE(3)同変幾何推論マニピュレーション2024/4/1
物体を正確に配置するタスクに対し、SE(3)同変性を持つ幾何推論層を導入し、少ないデモから高精度な相対姿勢予測を実現する手法を提案。
- RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback2024/2/1
- DiffTORI: 深層強化学習と模倣学習のための微分可能な軌道最適化強化学習/模倣学習2024/2/1
軌道最適化をポリシー表現として用い、そのコストとダイナミクス関数を微分可能最適化によりエンドツーエンドで学習する手法を提案し、強化学習と模倣学習の両方で従来手法を上回る性能を達成した。
- On Time-Indexing as Inductive Bias in Deep RL for Sequential Manipulation Tasks2024/1/1
- Object Importance Estimation using Counterfactual Reasoning for Intelligent Driving2023/12/1
- Force-Constrained Visual Policy: Safe Robot-Assisted Dressing via Multi-Modal Sensing2023/11/1
- RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation2023/11/1
- Reinforcement Learning in a Safety-Embedded MDP with Trajectory Optimization2023/10/1
- Learning Generalizable Tool-use Skills through Trajectory Generation2023/10/1
- FlowBot++: Learning Generalized Articulated Objects Manipulation via Articulation Projection2023/6/1
- One Policy to Dress Them All: Learning to Dress People with Diverse Poses and Garments2023/6/1
- HACMan: Learning Hybrid Actor-Critic Maps for 6D Non-Prehensile Manipulation2023/5/1
- Bagging by Learning to Singulate Layers Using Interactive Perception2023/3/1
- Self-supervised Cloth Reconstruction via Action-conditioned Cloth Tracking2023/2/1
- Active Velocity Estimation using Light Curtains via Self-Supervised Multi-Armed Bandits2023/2/1
- TAX-Pose: Task-Specific Cross-Pose Estimation for Robot Manipulation2022/11/1
- ToolFlowNet: Robotic Manipulation with Tools via Predicting Tool Flow from Point Clouds2022/11/1
- Learning to Grasp the Ungraspable with Emergent Extrinsic Dexterity2022/11/1
- Neural Grasp Distance Fields for Robot Manipulation2022/11/1
- Planning with Spatial-Temporal Abstraction from Point Clouds for Deformable Object Manipulation2022/10/1
- Differentiable Raycasting for Self-supervised Occupancy Forecasting2022/10/1
- AutoBag: Learning to Open Plastic Bags and Insert Objects2022/10/1
- Elastic Context: Encoding Elasticity for Data-driven Models of Textiles2022/9/1
- EDO-Net: Learning Elastic Properties of Deformable Objects from Graph Dynamics2022/9/1
- Visual Haptic Reasoning: Estimating Contact Forces by Observing Deformable Object Interactions2022/8/1
- Learning to Singulate Layers of Cloth using Tactile Feedback2022/7/1
- Learning Closed-loop Dough Manipulation Using a Differentiable Reset Module2022/7/1
- Mesh-based Dynamics with Occlusion Reasoning for Cloth Manipulation2022/6/1
- FlowBot3D: Learning 3D Articulation Flow to Manipulate Articulated Objects2022/5/1
- Self-supervised Transparent Liquid Segmentation for Robotic Pouring2022/3/1
- RB2: Robotic Manipulation Benchmarking with a Twist2022/3/1
- DiffSkill: Skill Abstraction from Differentiable Physics for Deformable Object Manipulations with Tools2022/3/1
- OSSID: Online Self-Supervised Instance Detection by (and for) Pose Estimation2022/1/1
- FabricFlowNet: Bimanual Cloth Manipulation with a Flow-based Policy2021/11/1
- Active Safety Envelopes using Light Curtains with Probabilistic Guarantees2021/7/1
- Learning Visible Connectivity Dynamics for Cloth Smoothing2021/5/1
- ZePHyR: Zero-shot Pose Hypothesis Rating2021/4/1
- Lyapunov Barrier Policy Optimization2021/3/1
- SoftGym: Benchmarking Deep Reinforcement Learning for Deformable Object Manipulation2020/11/1
- PLAS: Latent Action Space for Offline Reinforcement Learning2020/11/1
- ROLL: Visual Self-Supervised Reinforcement Learning with Object Reasoning2020/11/1
- Learning Off-Policy with Online Planning2020/8/1
- Uncertainty-aware Self-supervised 3D Data Association2020/8/1
- AB3DMOT: A Baseline for 3D Multi-Object Tracking and New Evaluation Metrics2020/8/1
- Cloth Region Segmentation for Robust Grasp Selection2020/8/1
- Active Perception using Light Curtains for Autonomous Driving2020/8/1
- Learning Orientation Distributions for Object Pose Estimation2020/7/1
- Multi-modal Transfer Learning for Grasping Transparent and Specular Objects2020/6/1
- Just Go with the Flow: Self-Supervised Scene Flow Estimation2019/12/1
- What You See is What You Get: Exploiting Visibility for 3D Object Detection2019/12/1
- Learning to Optimally Segment Point Clouds2019/12/1
- 3D Multi-Object Tracking: A Baseline and New Evaluation Metrics2019/7/1
- Reinforcement Learning without Ground-Truth State2019/5/1
- Adaptive Variance for Changing Sparse-Reward Environments2019/3/1
- PCN: Point Completion Network2018/8/1
- Reverse Curriculum Generation for Reinforcement Learning2017/7/1
- Automatic Goal Generation for Reinforcement Learning Agents2017/5/1
- Probabilistically Safe Policy Transfer2017/5/1
- Enabling Robots to Communicate their Objectives2017/2/1
- Learning to Track at 100 FPS with Deep Regression Networks2016/4/1
- Deep Learning for Single-View Instance Recognition2015/7/1