Ruixun Liu
収録論文 2本 ・ フィジカルAI/ロボット学習
音響知覚VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OmniEcho: 身体性エージェントのための空間音響理解音響知覚2026/9/20
実世界の空間音響・視覚シーンを集めたベンチマークOmniEchoBenchを構築し、一人称アンビソニックス音響を扱う全モーダルモデルOmniEchoを提案。音響による知覚・ナビゲーションで最先端性能を達成した。
- OccVLA: 暗黙的3D占有監督を備えた視覚-言語-行動モデルVLA2025/9/1
2D画像から3D占有を予測・監督信号として学習し、推論時には計算負荷を増やさずに自動運転の軌道計画と3D視覚質問応答で最高性能を達成したVLAモデル。