Yaowei Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA空間推論動作合成ナビゲーション視覚的位置認識
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NavHarness: エージェント型視覚言語ナビゲーションのための適応的ゴール設定VLA2026/9/30
視覚言語ナビゲーションにおいて、ゴール設定・検証・記憶圧縮・視覚運動実行の4エージェントで構成されるフレームワークを提案し、長期的タスクでの一貫性と推論効率を改善した。
- SpaceEra++: ビデオにおける3次元空間推論のための統合フレームワーク空間推論2026/7/2
本論文は、ビデオから3次元空間推論を行うための統合フレームワークSpaceEra++を提案する。フレーム選択戦略と空間整合手法を導入し、空間理解の精度を向上させた。
- 文脈内モデル予測生成:言語モデルから物理へのオープンボキャブラリ動作合成動作合成2026/6/1
テキスト記述から人間の動作を合成する際に、言語モデルの意味理解と物理シミュレーションの現実性を統合したフレームワークICMPGを提案し、オープンボキャブラリの指示に対して物理的に妥当な動作を生成する。
- ウェイポイントを超えて:視覚言語ナビゲーションのための軌跡中心のウェイポイントパラダイムナビゲーション2026/6/1
連続環境での視覚言語ナビゲーションにおいて、孤立したウェイポイントではなく実行可能な軌跡に基づく新しいウェイポイント予測手法を提案し、計画と制御の一貫性を向上させた。
- DAgger拡散ナビゲーション:視覚言語ナビゲーションのためのDAgger強化拡散ポリシーVLA2025/8/1
視覚言語ナビゲーション(VLN-CE)において、従来の2段階計画を単一の条件付き拡散ポリシーに統合し、DAggerによるオンライン学習で複合誤差を抑えたエンドツーエンド手法を提案。
- CricaVPR: 画像間相関を考慮した視覚的位置認識のための表現学習視覚的位置認識2024/2/1
バッチ内の複数画像の相関を注意機構で捉え、視点や照明の変化に頑健な位置認識用のグローバル表現を学習する手法を提案。