Deepali Jain
収録論文 18本 ・ フィジカルAI/ロボット学習
VLAsim2realマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- Gemini Robotics:AIを物理世界へVLA2025/3/1
Gemini 2.0を基盤に、ロボットを直接制御できる汎用VLAモデル「Gemini Robotics」と、空間・時間理解を強化した推論モデル「Gemini Robotics-ER」を提案した論文。
- RoPEを超えて:STRINGによる2D・3D位置エンコーディングの改善VLA2025/2/1
大規模言語モデルで広く使われるRotary Position Encodingsを統一的な理論枠組みで拡張し、任意次元のトークン座標に対して厳密な並進不変性を保ちつつ低計算コストで2D・3D位置エンコーディングを実現するSTRINGを提案。Vision Transformerに統合し、オープンボキャブラリ物体検出やロボティクス制御で性能向上を示した。
- 人間レベルの競技卓球を実現するロボットエージェントsim2real2024/8/1
階層型ポリシーとsim-to-real技術により、アマチュア人間レベルの競技卓球を実現したロボットを開発し、人間との試合で45%の勝率を達成した。
- 高密度視覚粒子ダイナミクスによる実世界のモデリングsim2real2024/6/1
10万粒子以上の潜在点群を処理する学習型ワールドモデルHD-VPDを提案し、双腕ロボットのダイナミクスを高精度かつ高速に予測できることを示した。
- 二本腕の身体性AI:ゼロショット学習、安全性、モジュール性マニピュレーション2024/4/1
自然言語指示に基づき二本腕ロボットが協調して長期的タスクをゼロショットで実行するモジュール型身体性AIシステムを提案。安全性とモジュール性を重視し、実世界データなしで動作する。
- SARA-RT: Scaling up Robotics Transformers with Self-Adaptive Robust Attention2023/12/1
- Robotic Table Tennis: A Case Study into a High Speed Learning System2023/9/1
- Agile Catching with Whole-Body MPC and Blackbox Policy Learning2023/6/1
- Barkour: Benchmarking Animal-level Agility with Quadruped Robots2023/5/1
- i-Sim2Real: Reinforcement Learning of Robotic Policies in Tight Human-Robot Interaction Loops2022/7/1
- Unlocking Pixels for Reinforcement Learning via Implicit Attention2021/2/1
- ES-ENAS: Efficient Evolutionary Optimization for Large Hybrid Search Spaces2021/1/1
- Disentangled Planning and Control in Vision Based Robotics via Reward Machines2020/12/1
- From Pixels to Legs: Hierarchical Learning of Quadruped Locomotion2020/11/1
- Learning Agile Locomotion Skills with a Mentor2020/11/1
- Reinforcement Learning with Chromatic Networks for Compact Architecture Search2019/7/1
- Hierarchical Reinforcement Learning for Quadruped Locomotion2019/5/1