Liuyi Wang
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NavJev: 行動中心の視覚圧縮と識別的行動意味記憶による効率的な視覚言語ナビゲーションVLA2026/9/28
MLLMの逐次推論をやめ、候補行動を圧縮表現に変換して軽量な確率的行動選択を行うことで、視覚言語ナビゲーションの推論遅延を大幅に削減したフレームワーク。
- DPed-VLN:動的歩行者環境における社会的規範に沿った視覚言語ナビゲーションのベンチマークVLA2026/9/18
歩行者が動く環境での視覚言語ナビゲーションを評価するHabitat 3.0ベンチマークを構築し、歩行者を考慮した強化学習・模倣学習ポリシーDPetを提案した。
- GaussianSeed: 高解像度3D占有予測のための階層的ガウスシーディング3D占有予測2026/7/22
高解像度の3D占有予測を効率的に行うため、粗密の階層構造を持つガウスプリミティブを用いたフレームワークを提案し、0.1m解像度でリアルタイム推論を実現した。
- 具現化視覚言語ナビゲーションの包括的サーベイと体系的実世界評価ナビゲーション2026/7/1
視覚と言語によるナビゲーション(VLN)の研究を体系的に分類し、物理ロボットでの実世界評価を行った。シミュレーションと実世界の性能差を明らかにし、階層的フレームワークの堅牢性を示した。
- P2DNav: パノラマから俯瞰への推論によるゼロショット視覚言語ナビゲーションナビゲーション2026/5/19
ゼロショットの視覚言語ナビゲーションにおいて、パノラマ方向選択と俯瞰ローカル接地を分離した階層的フレームワークを提案し、性能を向上させた。
- 動的知識空間による自動運転の非交絡生涯学習自動運転2026/3/1
自動運転の生涯学習における破滅的忘却や因果交絡を解決するため、ディリクレ過程混合モデルと因果推論のフロントドア調整を統合したフレームワークを提案した。
- RynnBrain: オープンな身体性基盤モデルVLA2026/2/1
知覚・推論・計画を統合した時空間基盤モデルRynnBrainを提案し、2B/8B/30B-A3B MoEの3規模と下流タスク向け4変種を公開、20の身体性ベンチマークで既存モデルを大幅に上回った。
- VLNVerse:多様・身体性・リアルなシミュレーションと評価を備えた視覚言語ナビゲーションのベンチマークVLN2025/12/1
視覚言語ナビゲーション(VLN)の既存ベンチマークの限界を克服するため、多様なタスクを統合し、物理エンジンによる身体性とリアルなシミュレーションを実現した大規模ベンチマークVLNVerseを提案し、既存手法の評価と統合マルチタスクモデルを提示した。
- CLASH: 連続的視覚言語ナビゲーションのための大規模・小規模協調階層フレームワークVLA2025/12/1
視覚言語ナビゲーションにおいて、小規模モデルと大規模モデルを不確実性に基づき協調させ、シミュレーションと実環境で最先端性能を達成した。
- 視覚言語ナビゲーションにおける身体性ギャップの再考:物理的・視覚的格差の包括的研究VLA2025/7/1
人型・四足・車輪ロボットに対応した物理的に現実的なVLN評価プラットフォームVLN-PEを提案し、既存のVLN手法が実機環境で性能劣化する要因を体系的に分析した。
- ECBench:マルチモーダル基盤モデルは自己中心的世界を理解できるか?包括的身体認知ベンチマークVLA2025/1/1
ロボットの自己認知や動的シーン知覚、幻覚といった身体認知能力を体系的に評価するため、30次元の認知軸を持つベンチマークECBenchと評価システムECEvaluを提案し、各種LVLMを評価した。
- Multiple Thinking Achieving Meta-Ability Decoupling for Object Navigation2023/2/1
- Search for or Navigate to? Dual Adaptive Thinking for Object Navigation2022/8/1