Xiaolu Liu
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーション自動運転/世界モデルマルチモーダル事前学習VLAセマンティックシーン補完
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 遅い推論器から速いプランナーへのトークン単位潜在ストリーミングによる動的視覚言語ナビゲーションナビゲーション2026/7/1
動的な人間中心環境での視覚言語ナビゲーションにおいて、遅いVLMの推論中に中間隠れ状態をストリーミングして高速なプランナーを逐次更新するSPARK-VLNを提案し、ナビゲーション成功率と社会的コンプライアンスを向上させた。
- DynFlowDrive: フローベース動的世界モデルによる自動運転自動運転/世界モデル2026/3/1
拡散フローで運転行動に応じたシーン状態の遷移を学習する潜在世界モデルを提案し、安定性を考慮した軌道選択で自動運転の計画信頼性を向上させた。
- 空間知能の構築:自律システムのためのマルチモーダル事前学習ロードマップマルチモーダル事前学習2025/12/1
自動運転車やドローンなどの自律システムに向けて、カメラやLiDARなどのマルチモーダルセンサーデータを活用した事前学習技術を整理し、統一的な分類と今後の課題・ロードマップを提示したサーベイ論文。
- 自動運転のための視覚-言語-行動モデル:過去・現在・未来VLA2025/12/1
自動運転における視覚-言語-行動(VLA)フレームワークの進化を整理し、End-to-End型とDual-System型の2つのパラダイムに分類して、その特徴と課題を概観したサーベイ論文。
- すべてのボクセルは平等ではない:自己蒸留を用いた難易度認識型セマンティックシーン補完セマンティックシーン補完2024/4/1
3D空間のボクセルごとに難易度を考慮し、学習が難しい領域を重点的に学習する自己蒸留ベースのセマンティックシーン補完手法を提案。
- LiDAR2Map: In Defense of LiDAR-Based Semantic Map Construction Using Online Camera Distillation2023/4/1