Pengxu Hou
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA能動SLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Vision-language-actionモデルの実用性を再考する:包括的ベンチマークと改良ベースラインVLA2026/2/1
VLAモデルの実用性を評価する新ベンチマークCEBenchを提案し、その知見に基づき軽量で実用的なLLaVA-VLAを開発した。
- Dream-SLAM: 動的環境における能動SLAMのための未観測領域の夢生成能動SLAM2026/2/1
部分的に観測された動的環境の時空間画像と意味構造を生成(夢見)し、実観測と融合することで、カメラ姿勢推定・3D地図生成・長期的な探索計画を改善する単眼能動SLAM手法を提案。
- VLA-Adapter:小型Vision-Language-Actionモデルのための効果的なパラダイムVLA2025/9/1
大規模VLMへの依存を減らし、0.5Bパラメータのバックボーンと軽量なPolicyモジュールでロボットデータの事前学習なしに高性能なVLAモデルを実現した研究。