Xiaoyu Li
収録論文 7本 ・ フィジカルAI/ロボット学習
マルチモーダル融合VLA3D多物体追跡マルチカメラ3D追跡
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MatchFusion: 時空間マルチモーダル自動運転のための明示的・暗黙的インスタンスマッチングマルチモーダル融合2026/9/22
LiDARとカメラの空間的融合および過去と現在の時間的融合において、幾何学的類似度とカテゴリ一致で初期対応を推定し、インスタンス埋め込みで曖昧な対応を精緻化する学習可能なマッチング・融合モジュールを提案。nuScenesで知覚精度の向上を実証。
- LARY: 汎用視覚-行動対応のための潜在行動表現ベンチマークVLA2026/4/1
人間の行動ビデオから学習した潜在行動表現の能力を評価する統一ベンチマークを構築し、汎用視覚基盤モデルが専門の潜在行動モデルより優れ、潜在空間が物理行動空間とより良く整合することを示した。
- Fusion-Poly: 時空間融合に基づく3D多物体追跡のための多面体フレームワーク3D多物体追跡2026/3/1
LiDARとカメラの非同期観測を活用し、同期・非同期タイムスタンプで軌道を更新する3D多物体追跡フレームワークを提案。
- RockTrack: 堅牢なマルチカメラ3D多物体追跡フレームワークマルチカメラ3D追跡2024/9/1
RockTrackは、マルチカメラ検出器に特化した3D多物体追跡手法で、検出器に依存せず、信頼度に基づく前処理と外観・幾何情報を融合した関連付けにより、nuScenesリーダーボードで最高性能を達成した。
- Fast-Poly: 3D多物体追跡のための高速多面体フレームワーク3D多物体追跡2024/3/1
3D多物体追跡のためのフィルタベース手法Fast-Polyを提案し、回転異方性の考慮や並列化により高速化と高精度化を実現した。
- Poly-MOT: A Polyhedral Framework For 3D Multi-Object Tracking2023/7/1
- GraphRQI: Classifying Driver Behaviors Using Graph Spectrums2019/10/1