Vikas Sindhwani
収録論文 34本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VeoワールドシミュレータによるGeminiロボティクスポリシーの評価sim2real2025/12/1
最先端の動画生成モデルVeoを基盤とした生成評価システムを構築し、ロボットポリシーの通常性能から分布外汎化、物理・意味的安全性までをシミュレーションで評価できることを示した。
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- Gemini Robotics:AIを物理世界へVLA2025/3/1
Gemini 2.0を基盤に、ロボットを直接制御できる汎用VLAモデル「Gemini Robotics」と、空間・時間理解を強化した推論モデル「Gemini Robotics-ER」を提案した論文。
- ロボット憲法の生成と意味的安全性のためのベンチマーク安全性2025/3/1
視覚言語モデルを搭載したロボットの意味的安全性を評価する大規模ベンチマークASIMOVを公開し、実世界データからロボット憲法を自動生成する枠組みを提案した。
- SF作品からロボットの倫理を学ぶ:SciFi-BenchmarkAI倫理2025/3/1
824のSF作品でAIやロボットが下した重要な決断を収集し、LLMの人間価値への整合性を測るベンチマークを構築。憲法生成により倫理的行動を促進できることを示した。
- RoPEを超えて:STRINGによる2D・3D位置エンコーディングの改善VLA2025/2/1
大規模言語モデルで広く使われるRotary Position Encodingsを統一的な理論枠組みで拡張し、任意次元のトークン座標に対して厳密な並進不変性を保ちつつ低計算コストで2D・3D位置エンコーディングを実現するSTRINGを提案。Vision Transformerに統合し、オープンボキャブラリ物体検出やロボティクス制御で性能向上を示した。
- 予測的レッドチーミング:ロボットを壊さずにポリシーを破るsim2real2025/2/1
生成画像編集とポリシー固有の異常検知器を用いて、視覚運動ポリシーの環境要因に対する脆弱性をハードウェア評価なしで予測するRoboARTを提案し、予測精度と的を絞ったデータ収集による性能向上を実証した。
- 人間レベルの競技卓球を実現するロボットエージェントsim2real2024/8/1
階層型ポリシーとsim-to-real技術により、アマチュア人間レベルの競技卓球を実現したロボットを開発し、人間との試合で45%の勝率を達成した。
- Mobility VLA:長文脈VLMとトポロジカルグラフによるマルチモーダル指示ナビゲーションナビゲーション/VLA2024/7/1
デモ動画と自然言語・画像の指示を入力とし、長文脈VLMで目標フレームを特定、トポロジカルグラフに基づく低レベル方策で実環境をナビゲートする階層型VLAを提案した。
- 高密度視覚粒子ダイナミクスによる実世界のモデリングsim2real2024/6/1
10万粒子以上の潜在点群を処理する学習型ワールドモデルHD-VPDを提案し、双腕ロボットのダイナミクスを高精度かつ高速に予測できることを示した。
- 二本腕の身体性AI:ゼロショット学習、安全性、モジュール性マニピュレーション2024/4/1
自然言語指示に基づき二本腕ロボットが協調して長期的タスクをゼロショットで実行するモジュール型身体性AIシステムを提案。安全性とモジュール性を重視し、実世界データなしで動作する。
- SARA-RT: Scaling up Robotics Transformers with Self-Adaptive Robust Attention2023/12/1
- Robotic Table Tennis: A Case Study into a High Speed Learning System2023/9/1
- Revisiting Energy Based Models as Policies: Ranking Noise Contrastive Estimation and Interpolating Energy Models2023/9/1
- Agile Catching with Whole-Body MPC and Blackbox Policy Learning2023/6/1
- Barkour: Benchmarking Animal-level Agility with Quadruped Robots2023/5/1
- Single-Level Differentiable Contact Simulation2022/12/1
- A Contextual Bandit Approach for Learning to Plan in Environments with Probabilistic Goal Configurations2022/11/1
- Robotic Table Wiping via Reinforcement Learning and Whole-body Trajectory Optimization2022/10/1
- Learning Model Predictive Controllers with Real-Time Attention for Real-World Navigation2022/9/1
- Multiscale Sensor Fusion and Continuous Control with Neural CDEs2022/3/1
- Trajectory Optimization with Optimization-Based Dynamics2021/9/1
- Learning to Rearrange Deformable Cables, Fabrics, and Bags with Goal-Conditioned Transporter Networks2020/12/1
- Piecewise-Linear Motion Planning amidst Static, Moving, or Morphing Obstacles2020/10/1
- Transporter Networks: Rearranging the Visual World for Robotic Manipulation2020/10/1
- Robotic Table Tennis with Model-Free Reinforcement Learning2020/3/1
- Policies Modulating Trajectory Generators2019/10/1
- Data Efficient Reinforcement Learning for Legged Robots2019/7/1
- Learning Stabilizable Nonlinear Dynamics with Contraction-Based Regularization2019/7/1
- Teleoperator Imitation with Continuous-time Safety2019/5/1
- Learning Stabilizable Dynamical Systems via Control Contraction Metrics2018/8/1
- Optimizing Simulations with Noise-Tolerant Structured Exploration2018/5/1
- Structured Evolution with Compact Architectures for Scalable Policy Optimization2018/4/1
- Learning Contracting Vector Fields For Stable Imitation Learning2018/4/1