Mingxiao Huo
収録論文 5本 ・ フィジカルAI/ロボット学習
操作VLA軌道予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DenseReward: 失敗合成によるロボット操作のための高密度報酬学習操作2026/7/1
ロボット操作の強化学習を改善するため、シミュレーションで物理的に現実的な失敗軌道を自動生成し、視覚と言語からフレーム単位の高密度報酬を予測する報酬モデルDenseRewardを提案した。
- VER: 基盤モデル蒸留と動的ルーティングによるロボット学習のための視覚エキスパートトランスフォーマーVLA2025/10/1
複数の視覚基盤モデルを蒸留してエキスパートライブラリを構築し、軽量なルーティングネットワークでタスクに応じた専門家を動的に選択することで、17種類のロボットタスクで最先端性能を達成した。
- スパース拡散方策:ロボット学習のためのスパースで再利用可能かつ柔軟な方策VLA2024/7/1
Transformerベースの拡散方策にMixture of Expertsを組み込み、タスクごとに専門家を選択的に活性化することで、マルチタスク学習や継続学習を効率化する手法を提案した。
- 事後サンプリングによる歩行者軌道の同時予測軌道予測2024/4/1
歩行者の過去と未来の軌道をまとめて拡散モデルで学習し、事後サンプリングによりノイズや欠損のある入力でも頑健に予測・生成できる手法GFTDを提案した。
- Human-oriented Representation Learning for Robotic Manipulation2023/10/1