Xinge Zhu
CUHK
収録論文 12本 ・ フィジカルAI/ロボット学習
アフォーダンス知覚模倣学習/行動生成VLA自動運転マニピュレーション点群位置合わせ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniAfford: トークンルーティング型マルチタスク学習による汎用可能な2D-3Dアフォーダンス知覚アフォーダンス知覚2026/9/29
MLLMを共通の意味ハブとし、タスク別トークンルーターで画像・点群のアフォーダンスクエリを生成することで、2D・3D・統合アフォーダンス知覚を単一枠組みで扱う手法を提案。
- 暗黙的ドリフト方策:条件付き専門家幾何による一段階行動生成模倣学習/行動生成2026/6/1
拡散やフローマッチングに基づく生成行動ポリシーは反復サンプリングが遅いため、一段階生成を提案。訓練時のドリフト補正を明示的なベクトル場推定なしで取り込む暗黙的ドリフト方策(IDP)を導入し、2D・3D・実世界操作タスクで有効性を実証した。
- ノイズから意図へ:残差ブリッジによる生成的VLAポリシーのアンカリングVLA2026/4/1
生成的VLAポリシーを「ノイズからの生成」から「意図からの精緻化」へと転換し、スペクトル解析で制御を低周波の意図と高周波の残差に分離して、残差拡散ブリッジで局所ダイナミクスを精緻化するResVLAを提案した。
- ReAL-AD: 人間らしい階層的推論を実現するエンドツーエンド自動運転自動運転2025/7/1
人間の認知モデルに基づく3層推論(戦略・判断・操作)をVLMで強化し、エンドツーエンド自動運転の計画精度と安全性を30%以上向上させたフレームワーク。
- FreqPolicy: 連続トークンによる周波数自己回帰型視覚運動ポリシーマニピュレーション2025/6/1
動作を周波数領域で表現し、低周波から高周波へ段階的に自己回帰生成する連続トークン型の視覚運動ポリシーを提案。2D/3D操作ベンチマークで精度と効率を両立。
- 点群ストリームと時系列バウンディングボックスの勾配降下法による位置合わせ点群位置合わせ2024/9/1
点群と時系列バウンディングボックスの位置合わせを、サイズ・形状・時間情報を活用した目的関数の勾配降下法で最適化し、IoUを40%改善した手法を提案。
- One Training for Multiple Deployments: Polar-based Adaptive BEV Perception for Autonomous Driving2023/4/1
- Rethinking Range View Representation for LiDAR Segmentation2023/3/1
- MV-FCOS3D++: Multi-View Camera-Only 4D Object Detection with Pretrained Monocular Backbones2022/7/1
- FCOS3D: Fully Convolutional One-Stage Monocular 3D Object Detection2021/4/1
- SelfVoxeLO: Self-supervised LiDAR Odometry with Voxel-based Deep Neural Networks2020/10/1
- TrafficPredict: Trajectory Prediction for Heterogeneous Traffic-Agents2018/11/1