Xiangchen Wang
収録論文 5本 ・ フィジカルAI/ロボット学習
ベンチマークVLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NutriBench-Kitchen:栄養管理のための身体化AIベンチマークベンチマーク2026/9/7
調理動画における栄養関連状態の追跡と知識に基づく計画を評価するベンチマークを提案し、既存の視覚言語モデルが人間性能に及ばないことを示した。
- ルートからステップへ:視覚言語ナビゲーションにおける意味的進捗と局所実行の分離VLA2026/8/1
視覚言語ナビゲーションにおいて、ルート全体の指示と局所的な行動生成を分離するフレームワークRoute2Stepを提案し、進捗追跡の誤りと実行の誤りを区別して学習する。
- LiveVLN: 視覚言語ナビゲーションにおける停止・再開ループの解消ナビゲーション2026/4/1
事前学習済みVLMナビゲータに多段階動作継続を追加し、実行と新規観測の処理を重ね合わせることで、待ち時間を削減し連続的なナビゲーションを実現するトレーニング不要のフレームワークを提案した。
- ActiveVLN: マルチターン強化学習による能動的探索を実現する視覚言語ナビゲーションVLA2025/9/1
視覚言語ナビゲーションにおいて、少数の模倣学習で初期化した後、マルチターン強化学習とGRPOで能動的に探索し、効率的に性能を向上させるフレームワークを提案。
- P³: 汎用性の高い身体性エージェントに向けてVLA2025/8/1
リアルタイム知覚と動的スケジューリングを統合し、ツールのフィードバックに依存せず多タスクを計画・実行する身体性エージェントの枠組みを提案し、能動的知覚のベンチマークATPを構築した。