Animesh Garg
収録論文 95本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CAPEX: 経験適応型推論による基盤モデル行動の展開可能なロボットポリシーへの効率的蒸留VLA2026/9/26
マルチモーダル基盤モデルを自律的な実演者として使い、過去の実行経験に応じて再計画の頻度を適応させることで、低コストでロボットポリシー学習用データを収集するフレームワークCAPEXを提案した。
- KeyGen: カテゴリーレベルの方策汎化のための教師なしキーポイントに基づく物体中心表現マニピュレーション2026/9/23
点群から物体の意味的3Dキーポイントを教師なしで学習し、それを物体中心表現として拡散方策に組み込むことで、未知の物体形状や姿勢に対しても汎化するマニピュレーション手法を提案。
- 模倣を超えて:オフポリシーQプランニングによるロボットポリシーの自己改善ロボット学習2026/8/21
大規模な視覚運動BCポリシーに小さなオフポリシーQ関数を組み合わせ、推論時の価値誘導選択とオンライン自己改善を実現。失敗データを活用してベンチマークと実ロボットタスクの成功率を大幅に向上させた。
- FORGE: キーポイント軌道推論による機能的一般化を目指したツール使用マニピュレーション2026/7/1
ロボットが特定の道具にしか使えない問題を解決するため、道具の機能に基づく一般化を実現する手法を提案。キーポイント軌道を中間表現として用い、機能推論と動作実行を分離する2段階ポリシーを開発し、未見の道具での成功率を2倍以上向上させた。
- スペクトル分解による階層的ポリシー学習マニピュレーション2026/6/1
ロボットの行動系列をスペクトル分解し、低周波成分で大まかな動き、高周波成分で精密な調整を捉える階層的ポリシーを提案。シミュレーションと実機で精密操作タスクの性能を向上させた。
- チャンクベースロボットポリシーのための動的実行ホライズン予測ロボットポリシー2026/6/1
固定実行ホライズンに依存するチャンクベースのロボットポリシーに対し、強化学習で軽量な実行ホライズン予測ブランチを学習し、事前学習済みポリシーを凍結したまま動的に実行長を調整する手法を提案。高精度・長時間タスクの成功率を大幅に向上させた。
- COBALT: スマートフォンを用いたクラウドベース遠隔操作によるロボット学習のクラウドソーシング遠隔操作/データ収集2026/5/1
スマートフォンなどの一般的なデバイスを用いて、複数ユーザーが同時に遠隔操作でロボットのデモデータを収集できるプラットフォームを提案し、模倣学習のための大規模データ収集を低コストで実現した。
- SoftMimicGen: 変形物体操作のためのスケーラブルなロボット学習データ生成システムデータ生成/変形物体操作2026/3/1
変形物体操作タスク向けに、高忠実度シミュレーション環境と自動データ生成パイプラインを構築し、生成データで高性能なポリシーを学習できることを示した論文。
- MATTERIX:ロボティクス支援化学実験室自動化のためのデジタルツインsim2real2026/1/1
化学実験室の高忠実度デジタルツインを構築するGPU加速マルチスケールロボットシミュレーションフレームワークを提案し、ロボット操作・粉体/液体動力学・熱伝達・化学反応を統合してsim-to-real転移を実証した。
- ReinforceGen:自動データ生成と強化学習によるハイブリッドスキルポリシーマニピュレーション2025/12/1
タスクを局所的なスキルに分解し、10件の人間デモから模倣学習で初期方策を構築した後、強化学習で微調整する長期的マニピュレーション手法を提案。
- Isaac Lab:マルチモーダルロボット学習のためのGPU加速シミュレーションフレームワークsim2real2025/11/1
GPU並列物理演算とフォトリアル描画を統合し、強化学習・模倣学習を大規模に実行できるロボット学習用シミュレーションプラットフォームを提案。
- TopoCut: スペクトル報酬と離散拡散ポリシーによる多段階切断の学習マニピュレーション2025/9/1
変形物体の多段階ロボット切断のためのベンチマークを提案し、位相追跡・スペクトル報酬・拡散ポリシーを統合して切断品質の評価と汎化性能を向上させた。
- AMPLIFY: ロボット学習のためのアクションなし動き事前分布VLA2025/6/1
アクションラベルなしの大規模動画からキーポイント軌跡を離散モーショントークンに符号化し、順動力学と逆動力学を分離して学習することで、ロボット方策の汎化性能を向上させるフレームワーク。
- OG-VLA: 正投影画像生成による3D認識型視覚言語行動モデルVLA2025/6/1
多視点RGBD観測を正投影画像に変換し、LLMと拡散モデルでエンドエフェクタの次位置・姿勢を生成する3D認識型VLAを提案。未見環境への汎化性能を大幅に向上。
- SuFIA-BC: 手術サブタスクにおける視覚運動ポリシー学習のための高品質デモンストレーションデータ生成手術ロボット/模倣学習2025/4/1
手術ロボットの自律化に向け、フォトリアルな臓器を含む手術デジタルツインを構築し、視覚行動クローニング用の高品質合成データを生成する手法を提案。多視点カメラや3D表現を検証し、既存手法が接触の多い複雑な手術タスクに苦戦することを示した。
- Adapt3R: 模倣学習におけるドメイン転移のための適応的3Dシーン表現模倣学習/3D表現2025/3/1
事前学習済み2Dバックボーンで意味情報を抽出し、3Dはエンドエフェクタ基準の位置情報としてのみ使う汎用3D観測エンコーダを提案し、未知の身体構造やカメラ視点へのゼロショット転移を実現した。
- AIとロボット科学者による科学発見のスケーリング則自律実験/ロボット科学者2025/3/1
エージェントAIと身体性ロボティクスを統合した自律型汎用科学者(AGS)を構想し、研究ライフサイクル全体の自動化と新たなスケーリング則の可能性を論じた論文。
- AnyPlace: ロボット操作のための汎用物体配置学習マニピュレーション2025/2/1
VLMで大まかな配置位置を特定し、合成データのみで訓練したモデルで多様な配置姿勢を予測する2段階手法を提案。実世界の様々な物体形状や配置モードに対応し、高精度な配置を実現。
- AIとロボティクスによる自然科学実験室の加速的発見:2024年IEEE ICRAワークショップからの展望と課題実験室自動化2025/1/1
2024年のIEEE ICRAワークショップで、自然科学実験室の自動化における課題と展望を専門家が議論し、自律性、再現性、標準化、倫理などの問題を整理した。
- DiffSim2Real: 微分可能シミュレータのみで訓練した四足歩行ポリシーの実機展開sim2real2024/11/1
微分可能シミュレータで解析的勾配を用いて訓練した四足歩行ポリシーを、滑らかな接触モデルにより実世界に転移させることに成功した。
- RoCoDA: 実演からのデータ効率的なロボット学習のための反事実的データ拡張マニピュレーション2024/11/1
模倣学習において、不変性・同変性・因果性を統合したデータ拡張手法RoCoDAを提案し、5つのマニピュレーションタスクで性能・汎化・サンプル効率を改善した。
- CLIMB: 言語ガイドによる反復モデル構築を伴う継続的タスクプランニング学習タスクプランニング2024/10/1
基盤モデルと実行フィードバックを活用し、自然言語記述からドメインモデルを構築しながら未知の述語を学習・蓄積する継続的タスクプランニング手法を提案。
- SPIRE: 長期的操作のための計画・模倣・強化学習の相乗的統合マニピュレーション2024/10/1
タスク・動作計画でタスクを分解し、模倣学習と強化学習を組み合わせて長期的なロボット操作を効率的に学習する手法を提案。
- 離散表現学習によるロボットインタラクションモードの発見マニピュレーション2024/10/1
関節物体を操作するロボットの動作を、専門家ラベルなしの教師なし学習で離散的な「インタラクションモード」として獲得し、それに基づく行動予測を可能にする手法ActAIM2を提案した。
- QueST: 連続制御学習のための自己教師ありスキル抽象化模倣学習2024/7/1
潜在変数モデルで行動系列を圧縮し、因果的帰納バイアスを導入することで、マルチタスクや少数ショット学習に強い低レベルスキル表現を学習する手法を提案。
- PWM: マルチタスク世界モデルによる方策学習モデルベース強化学習2024/7/1
世界モデルをオフラインデータで事前学習し、一次最適化でタスクごとに10分以内に方策を抽出する連続制御のモデルベース強化学習手法を提案。最大152次元の行動空間や80タスクにスケールし、既存手法を上回る性能を示した。
- 接触の多い微分可能シミュレーションにおける適応的ホライズンアクター・クリティック強化学習2024/5/28
剛体接触を含む微分可能シミュレーションで、モデルベースのホライズンを適応的に調整して勾配誤差を減らす強化学習アルゴリズムを提案し、歩行タスクで既存手法より40%高い報酬を達成した。
- 部品ベースの組み合わせ可能なマニピュレーションマニピュレーション2024/5/1
物体を部品に分解し、部品間の機能的対応関係を拡散モデルで学習することで、新しい物体やカテゴリにも汎化するロボット操作手法を提案した。
- SuFIA: 言語ガイドによる手術支援ロボットの拡張巧緻性手術ロボット/言語誘導2024/5/1
大規模言語モデルと知覚モジュールを組み合わせ、自然言語指示で手術支援ロボットのサブタスクを学習なしに実行する枠組みを提案し、シミュレーションと実機で検証した。
- ORBIT-Surgical: 手術支援巧緻性学習のためのオープンシミュレーションフレームワークsim2real2024/4/1
NVIDIA Omniverse上でdVRKとSTARロボット向けに14の手術タスクを提供し、強化学習・模倣学習による手術スキル向上とsim-to-real転移を可能にする物理ベースの手術ロボットシミュレータを開発した。
- AdaDemo: 汎用ロボットエージェントのためのデータ効率的なデモンストレーション拡張模倣学習2024/4/1
既存方策の弱点を特定し、適応的にデモンストレーションを収集・拡張することで、データ効率的に多タスク模倣学習を改善するフレームワークAdaDemoを提案。
- clutter環境におけるテレオペレーションのための高速明示的入力支援テレオペレーション2024/2/1
ロボット遠隔操作において、エンドエフェクタで目標を明示的に指し示す新しい支援インターフェースを提案し、暗黙的な意図推定支援と比較して、操作者の好みや作業負荷の低減、ピック失敗の減少を示した。
- RePLan: Robotic Replanning with Perception and Language Models2024/1/1
- ORGANA: A Robotic Assistant for Automated Chemistry Experimentation and Characterization2024/1/1
- Geometry Matching for Multi-Embodiment Grasping2023/12/1
- HandyPriors: Physically Consistent Perception of Hand-Object Interactions with Differentiable Priors2023/11/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Fast-Grasp'D: Dexterous Multi-finger Grasp Generation Through Differentiable Simulation2023/6/1
- Self-Supervised Learning of Action Affordances as Interaction Modes2023/5/1
- Errors are Useful Prompts: Instruction Guided Task Programming with Verifier-Assisted Iterative Prompting2023/3/1
- MVTrans: Multi-View Perception of Transparent Objects2023/2/1
- Orbit: A Unified Simulation Framework for Interactive Robot Learning Environments2023/1/1
- Chemistry Lab Automation via Constrained Task and Motion Planning2022/12/1
- nerf2nerf: Pairwise Registration of Neural Radiance Fields2022/11/1
- NeurIPS 2022 Competition: Driving SMARTS2022/11/1
- See, Plan, Predict: Language-guided Cognitive Planning with Video Prediction2022/10/1
- Breaking Bad: A Dataset for Geometric Fracture and Reassembly2022/10/1
- MoCoDA: Model-based Counterfactual Data Augmentation2022/10/1
- ProgPrompt: Generating Situated Robot Task Plans using Large Language Models2022/9/1
- Grasp'D: Differentiable Contact-rich Grasp Synthesis for Multi-fingered Hands2022/8/1
- Neural Motion Fields: Encoding Grasp Trajectories as Implicit Value Functions2022/6/1
- Neural Shape Mating: Self-Supervised Object Assembly with Adversarial Shape Priors2022/5/1
- Accelerated Policy Learning with Parallel Differentiable Simulation2022/4/1
- DiSECt: A Differentiable Simulator for Parameter Inference and Control in Robotic Cutting2022/3/1
- Continuous-Time Fitted Value Iteration for Robust Policies2021/10/1
- Seeing Glass: Joint Point Cloud and Depth Completion for Transparent Objects2021/10/1
- Real Robot Challenge: A Robotics Competition in the Cloud2021/9/1
- PlaTe: Visually-Grounded Planning with Transformers in Procedural Tasks2021/9/1
- Transferring Dexterous Manipulation from GPU Simulation to a Remote Real-World TriFinger2021/8/1
- A Persistent Spatial Semantic Representation for High-level Natural Language Instruction Execution2021/7/1
- Learning Latent Actions to Control Assistive Robots2021/7/1
- GIFT: Generalizable Interaction-aware Functional Tool Affordances without Labels2021/6/1
- Robust Value Iteration for Continuous Control Tasks2021/5/1
- DiSECt: A Differentiable Simulation Engine for Autonomous Robotic Cutting2021/5/1
- Value Iteration in Continuous Actions, States and Time2021/5/1
- GLiDE: Generalizable Quadrupedal Locomotion in Diverse Environments with a Centroidal Model2021/4/1
- Articulated Object Interaction in Unknown Scenes with Whole-Body Mobile Manipulation2021/3/1
- LASER: Learning a Latent Action Space for Efficient Reinforcement Learning2021/3/1
- Learning by Watching: Physical Imitation of Manipulation Skills from Human Videos2021/1/1
- Emergent Hand Morphology and Control from Optimizing Robust Grasps of Diverse Objects2020/12/1
- Solving Physics Puzzles by Reasoning about Paths2020/11/1
- Dynamics Randomization Revisited:A Case Study for Quadrupedal Locomotion2020/11/1
- Latent Skill Planning for Exploration and Transfer2020/11/1
- Conservative Safety Critics for Exploration2020/10/1
- Learning a Contact-Adaptive Controller for Robust, Efficient Legged Locomotion2020/9/1
- Visuomotor Mechanical Search: Learning to Retrieve Target Objects in Clutter2020/8/1
- Counterfactual Data Augmentation using Locally Factored Dynamics2020/7/1
- LEAF: Latent Exploration Along the Frontier2020/5/1
- Guided Uncertainty-Aware Policy Optimization: Combining Learning and Model-Based Strategies for Sample-Efficient Policy Learning2020/5/1
- IRIS: Implicit Reinforcement without Interaction at Scale for Learning Control from Offline Robot Manipulation Data2019/11/1
- Motion Reasoning for Goal-Based Imitation Learning2019/11/1
- Scaling Robot Supervision to Hundreds of Hours with RoboTurk: Robotic Manipulation Dataset through Human Reasoning and Dexterity2019/11/1
- Dynamics Learning with Cascaded Variational Inference for Multi-Step Manipulation2019/10/1
- Controlling Assistive Robots with Learned Latent Actions2019/9/1
- Continuous Relaxation of Symbolic Planner for One-Shot Imitation Learning2019/8/1
- Making Sense of Vision and Touch: Learning Multimodal Representations for Contact-Rich Tasks2019/7/1
- Variable Impedance Control in End-Effector Space: An Action Space for Reinforcement Learning in Contact-Rich Tasks2019/6/1
- Mechanical Search: Multi-Step Retrieval of a Target Object Occluded by Clutter2019/3/1
- RoboTurk: A Crowdsourcing Platform for Robotic Skill Learning through Imitation2018/11/1
- Making Sense of Vision and Touch: Self-Supervised Learning of Multimodal Representations for Contact-Rich Tasks2018/10/1
- Neural Task Graphs: Generalizing to Unseen Tasks from a Single Video Demonstration2018/7/1
- Learning Task-Oriented Grasping for Tool Manipulation from Simulated Self-Supervision2018/6/1
- Neural Task Programming: Learning to Generalize Across Hierarchical Tasks2017/10/1
- ADAPT: Zero-Shot Adaptive Policy Transfer for Stochastic Dynamical Systems2017/7/1
- HIRL: Hierarchical Inverse Reinforcement Learning for Long-Horizon Tasks with Delayed Rewards2016/4/1