Xian Wu
収録論文 7本 ・ フィジカルAI/ロボット学習
マルチモーダル融合ビデオ世界モデル3D多物体追跡モデルベース強化学習自動運転計画マルチカメラ3D追跡
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MatchFusion: 時空間マルチモーダル自動運転のための明示的・暗黙的インスタンスマッチングマルチモーダル融合2026/9/22
LiDARとカメラの空間的融合および過去と現在の時間的融合において、幾何学的類似度とカテゴリ一致で初期対応を推定し、インスタンス埋め込みで曖昧な対応を精緻化する学習可能なマッチング・融合モジュールを提案。nuScenesで知覚精度の向上を実証。
- RoboAlign-R1: ロボットビデオ世界モデルのための蒸留型マルチモーダル報酬アライメントビデオ世界モデル2026/5/1
ロボットビデオ世界モデルの訓練を、再構成損失などの低レベル目的ではなく、指示追従や操作成功などの意思決定に重要な能力に合わせるため、報酬アライメントと長期推論安定化を組み合わせたフレームワークを提案した。
- Fusion-Poly: 時空間融合に基づく3D多物体追跡のための多面体フレームワーク3D多物体追跡2026/3/1
LiDARとカメラの非同期観測を活用し、同期・非同期タイムスタンプで軌道を更新する3D多物体追跡フレームワークを提案。
- 計画としての時空間予測:生成的世界モデルを用いたモデルベース強化学習アプローチモデルベース強化学習2025/10/5
時空間予測をモデルベース強化学習の問題として捉え、生成的世界モデルとビーム探索による計画で非微分な評価指標を報酬として活用し、極端事象の捕捉精度を高める手法を提案した。
- シーン適応型運動計画:明示的専門家混合と相互作用指向最適化自動運転計画2025/5/1
複雑な都市環境での自動運転軌道計画の課題に対し、シーンに応じて専門家を動的に選択する明示的MoEと相互作用を考慮した最適化を組み合わせたEMoE-Plannerを提案し、NuplanデータセットでSOTA性能を達成した。
- RockTrack: 堅牢なマルチカメラ3D多物体追跡フレームワークマルチカメラ3D追跡2024/9/1
RockTrackは、マルチカメラ検出器に特化した3D多物体追跡手法で、検出器に依存せず、信頼度に基づく前処理と外観・幾何情報を融合した関連付けにより、nuScenesリーダーボードで最高性能を達成した。
- Fast-Poly: 3D多物体追跡のための高速多面体フレームワーク3D多物体追跡2024/3/1
3D多物体追跡のためのフィルタベース手法Fast-Polyを提案し、回転異方性の考慮や並列化により高速化と高精度化を実現した。