Zhanqi Zhang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA操作学習自動運転/動作計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TaskAnchor: 長期的マニピュレーションのための反応型VLAにおけるタスク状態の接地VLA2026/9/20
視覚的に似た観測でも実行段階によって行動が異なる「タスク状態の曖昧さ」を解消するため、実行履歴に基づく軽量アダプタTaskAnchorを提案し、VLAの成功率を大幅に向上させた。
- Dexterity-BEV: 3D世界と行動の整合による汎用ロボットポリシー学習操作学習2026/6/1
2D基盤モデルの限界を克服するため、カメラ校正と深度を用いて2D入力を3D頂点マップに変換し、BEV座標系で入力と行動を整合させることで、視点変化に頑健で汎用的な操作ポリシーを学習する手法を提案した。
- 一度見れば実行できる:ワンショット動画デモからタスクを学習する視覚-言語-行動モデルVLA2025/12/1
テスト時に1本の専門家デモ動画を見るだけで新しい操作スキルを獲得できるVLAモデルViVLAを提案し、未見タスクで30%以上の性能向上を達成した。
- PIE: 自動運転のための知覚・インタラクション強化型エンドツーエンド動作計画自動運転/動作計画2025/9/1
カメラとLiDARの融合に双方向Mambaを、軌道推論にMambaとMixture-of-Expertsを組み合わせ、周囲エージェントとの相互作用を考慮した自動運転のエンドツーエンド動作計画フレームワークを提案し、NAVSIMベンチマークで最高性能を達成した。
- DRAMA: Mambaを用いた自動運転向け高効率エンドツーエンド動作プランナ自動運転/動作計画2024/8/1
MambaをベースにカメラとLiDARの特徴を融合し、低計算コストで将来の自車軌道を生成する自動運転用エンドツーエンド動作プランナを提案。