Yang Wu
Institute of Automation, Chinese Academy of Sciences
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA自動運転LiDAR生成世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Mind-VLA: 指示認識型空間表現アライメントによる視覚言語行動モデルVLA2026/8/1
言語指示で指定された対象物体の3D幾何に焦点を当て、VLAモデルの表現をアライメントする手法を提案。LIBEROやCALVINで高精度を達成し、実ロボットの遮蔽タスクでも大幅な性能向上を示した。
- 思考の蒸留と行動の予見:自動運転のための認知物理強化学習自動運転2026/5/20
自動運転のための認知物理強化学習フレームワークCoPhyを提案。VLM知識を蒸留して認知能力を保持しつつ、BEV世界モデルで将来予測を行い、安全と意図適合の二重報酬でポリシーを最適化する。
- OmniLiDAR: マルチドメイン3D LiDAR生成のための統一拡散フレームワークLiDAR生成2026/5/1
異なるセンサー条件やプラットフォームにわたる8つのドメインでLiDARスキャンを生成する統一テキスト条件付き拡散モデルを提案し、ドメイン間の特徴シフトを扱う新しいトレーニング戦略と特徴変調を導入した。
- 3D・4D世界モデリングのサーベイ世界モデル2025/9/1
RGB-D画像や占有グリッド、LiDAR点群といったネイティブな3D/4D表現を用いた世界モデリング研究を初めて体系的に整理し、定義・分類・データセット・評価指標をまとめたサーベイ。
- Veila: 単眼RGB画像からのパノラマLiDAR生成LiDAR生成2025/8/1
単眼RGB画像を条件として、拡散モデルによりパノラマLiDAR点群を生成するフレームワークを提案。信頼度に基づく条件付けと幾何学的整合性により、RGBとLiDARのモダリティギャップを克服する。
- Origami-inspired soft twisting actuator2021/11/1