Pannag Sanketi
収録論文 14本 ・ フィジカルAI/ロボット学習
VLA模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 自己改善する身体性基盤モデルVLA2025/9/1
ロボット基盤モデルの事後学習を2段階(行動クローン+残りステップ予測のSFT、その後自己改善)で行い、人手を最小限に自律的なスキル獲得と高い成功率を実現した研究。
- SAS-Prompt: 大規模言語モデルを数値最適化器として活用したロボットの自己改善VLA2025/4/1
LLMが数値最適化を行える点に着目し、過去のロボット軌道を要約・分析・統合する単一プロンプト(SAS-Prompt)でロボット方策を反復的に自己改善する手法を提案。シミュレーションと実機の卓球タスクで検証した。
- Gemini Robotics:AIを物理世界へVLA2025/3/1
Gemini 2.0を基盤に、ロボットを直接制御できる汎用VLAモデル「Gemini Robotics」と、空間・時間理解を強化した推論モデル「Gemini Robotics-ER」を提案した論文。
- 相互情報量推定によるロボットデモデータの品質選別模倣学習2025/2/1
ロボットの模倣学習データについて、状態と行動の相互情報量への各軌道の寄与をVAE埋め込みとk近傍推定で評価し、デモの品質を選別する手法を提案した。
- OpenVLA: オープンソースの視覚-言語-行動モデルVLA2024/6/1
97万件の実機ロボット実演で学習した7BパラメータのオープンソースVLAモデルを提案し、閉源モデルRT-2-Xを上回る汎用マニピュレーション性能と効率的なファインチューニングを実現した。
- Octo: オープンソースの汎用ロボットポリシーVLA2024/5/1
80万件の軌道データで学習したTransformerベースの汎用ロボットマニピュレーションポリシーを提案し、言語や目標画像で指示でき、新しいセンサーや行動空間にも短時間でファインチューニング可能であることを示した。
- VADER: マルチロボット・人間協調のための視覚的アフォーダンス検出とエラー回復VLA2024/5/1
視覚的アフォーダンス検出とエラー認識を行い、他ロボットや人間への助け要請を新たなスキルとして組み込むことで、長期的タスクの中断から回復して完遂するフレームワークVADERを提案した。
- AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents2024/1/1
- RoboVQA: Multimodal Long-Horizon Reasoning for Robotics2023/11/1
- RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control2023/7/1
- Agile Catching with Whole-Body MPC and Blackbox Policy Learning2023/6/1
- Bi-Manual Block Assembly via Sim-to-Real Reinforcement Learning2023/3/1
- RT-1: Robotics Transformer for Real-World Control at Scale2022/12/1
- Robotic Table Tennis with Model-Free Reinforcement Learning2020/3/1