Andrey Kolobov
Microsoft Research
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Rho: 効率的に適応可能なVLAモデルの基盤VLA2026/9/29
双腕マニピュレーション向けのオープンウェイトVLAモデル群「Rho」を提案し、3つの実機での少量データ適応と、15エピソード程度の修正フィードバックによるオンライン適応を実現した。
- FlowDAgger: 潜在空間における人間参加型生成ロボットポリシーの適応模倣学習/適応2026/7/1
事前学習済みの生成ロボットポリシーを、人間の介入から潜在空間で適応させる手法を提案。介入行動を逆変換してノイズに変換し、軽量な潜在ポリシーで基盤モデルを操縦することで、少数の介入から迅速にスキル獲得する。
- オフロードかオーバーロードか:移動型ロボットマニピュレーション作業負荷のプラットフォーム計測研究移動マニピュレーション2026/3/1
移動型ロボットマニピュレーションの計算負荷をオンボード・エッジ・クラウドGPUで計測し、オフロードの利点と課題、ロボット群での計算共有の可能性を明らかにした。
- 多様なリセットと大規模強化学習による創発的な器用さ器用操作/強化学習2026/3/1
シミュレータのリセットを多様化して強化学習に様々なロボットと物体の相互作用を経験させることで、単一の報酬関数と固定ハイパーパラメータで長時間の器用な操作タスクを解くフレームワークOmniResetを提案した。
- 一段階フローポリシーによる潜在方針の操縦オフライン強化学習2026/3/1
オフライン強化学習において、元の行動空間のQ勾配を微分可能な一段階MeanFlowポリシーを通じて逆伝播させ、潜在行動空間のアクターを更新する新しい手法LPSを提案。代理の潜在批評家を排除し、行動制約付き生成事前分布として機能させることで、最小限のチューニングで高い性能を達成した。
- BusyBox:視覚言語行動モデルのアフォーダンス汎化を評価する物理ベンチマークVLA2026/2/1
スイッチやスライダーなど6モジュールを交換・回転できる物理ベンチマークBusyBoxを提案し、強いVLAモデルでも見た目が変わるとアフォーダンス汎化が難しいことを実証した。
- LoLA: 汎用ロボットマニピュレーションのための長期的潜在行動学習マニピュレーション2025/12/1
多視点観測と固有感覚を統合し、視覚言語表現をロボットの運動空間に接地させることで、長期的な言語誘導マニピュレーションを可能にするフレームワークLoLAを提案した。
- TwinVLA: 双子の単腕VLAモデルによるデータ効率的な両腕マニピュレーションマニピュレーション2025/11/1
事前学習済みの単腕VLAモデルを2つ組み合わせて両腕タスクを実行するフレームワークを提案し、両腕データなしで高性能を実現した。
- TraceVLA:視覚トレースプロンプトで汎用ロボットポリシーの時空間認識を強化VLA2024/12/1
状態行動軌跡を視覚的にエンコードする視覚トレースプロンプトを導入し、VLAモデルの時空間認識を改善。15万件の操作軌跡でOpenVLAを微調整したTraceVLAは、シミュレーションと実機で大幅な性能向上を達成。
- WindSeer: Real-time volumetric wind prediction over complex terrain aboard a small UAV2024/1/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Interactive Robot Learning from Verbal Correction2023/10/1
- Goal Representations for Instruction Following: A Semi-Supervised Language Interface to Control2023/7/1
- PLEX: Making the Most of the Available Data for Robotic Manipulation Pretraining2023/3/1
- Exploring Levels of Control for a Navigation Assistant for Blind Travelers2023/1/1
- MoCapAct: A Multi-Task Dataset for Simulated Humanoid Control2022/8/1
- Safe Reinforcement Learning via Curriculum Induction2020/6/1
- Autonomous Thermalling as a Partially Observable Markov Decision Process (Extended Version)2018/5/1
- ArduSoar: an Open-Source Thermalling Controller for Resource-Constrained Autopilots2018/2/1