Wanting Li
収録論文 6本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- クリティック・イン・ザ・ループ:堅牢な長時間操作のための三系統VLAフレームワークマニピュレーション2026/3/1
VLMの高次推論とVLAの高速実行を、軽量な視覚クリティックが動的に切り替える階層型フレームワークを提案し、長時間操作の堅牢性を向上させた。
- Progress-Think: 視覚言語ナビゲーションのための意味的進捗推論VLA2025/11/1
視覚観測から指示文の進捗を意味的に推論し、ナビゲーション方策を導く三段階フレームワークを提案。R2R-CEとRxR-CEで最高性能を達成。
- MonoDream:パノラマドリーミングによる単眼視覚言語ナビゲーションVLA2025/8/1
単眼入力のみでパノラマRGB-D相当の空間表現を潜在空間で学習し、視覚言語ナビゲーションの性能を向上させる軽量VLAフレームワークを提案。
- Aux-Think: データ効率の良い視覚言語ナビゲーションのための推論戦略の探求VLA2025/5/1
視覚言語ナビゲーション(VLN)において推論戦略を体系的に評価し、推論時の推論崩壊問題を明らかにした上で、CoT教師あり学習で推論パターンを内部化しつつ直接行動予測を行うAux-Thinkを提案した。
- OminiAdapt: ロバストで環境認識型のロボットマニピュレーションに向けたクロスタスク不変性の学習模倣学習2025/3/1
ヒューマノイドロボットの模倣学習において、背景除去とチャネル特徴融合・空間アテンション、動的重み更新により環境擾乱を抑え、タスク成功率を高める手法を提案した。
- IDLS: Inverse Depth Line based Visual-Inertial SLAM2023/4/1