Pengyuan Wu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA探索拡散ポリシー/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MixVLA: 非不変情報の適応的混合による汎化可能な視覚-言語-行動モデルVLA2026/10/2
VLAモデルの汎化性能を高めるため、環境固有の非不変表現を確率的に混合して正則化する学習フレームワークを提案し、OOD条件下でのロバスト性を向上させた。
- WOLF: 予測フロンティアを用いた世界モデル誘導LiDAR探索探索2026/9/20
LiDAR搭載UAVの自律探索において、再帰的世界モデルで将来の観測を予測し、予測フロンティアを生成することで遮蔽物の先の有望領域を推定し探索効率を高める手法を提案。
- 動的補正を備えた閉ループアクションチャンクによる学習不要の拡散ポリシー拡散ポリシー/操作2026/3/1
拡散ベースのポリシーに動的環境情報を注入し、リアルタイムでアクションを補正する閉ループ拡散ポリシーフレームワークDCDPを提案。再学習なしで動的シナリオへの適応性を向上させる。
- 左脳から右脳へ:視覚と言語によるナビゲーションのための適応的テキストドリーマーVLA2025/5/1
視覚と言語によるナビゲーション(VLN)において、LLMをベースに左脳(論理統合)と右脳(想像的予測)の二重分岐構造で将来の環境意味を言語形式で適応的に想像し、ナビゲーション専門モジュールと統合する手法を提案。R2Rベンチマークで少ないパラメータで最先端性能を達成。