Zhihao Zhan
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 回転ミリ波レーダによる複雑な農地における農業用UAVの地形認識センシング2026/5/1
農業用UAVの地形追従飛行のため、低コストの回転ミリ波レーダを用いた地形認識フレームワークを提案し、実機実験で地形推定精度を向上させた。
- MAG-VLAQ: マルチモーダル航空・地上クエリ集約によるクロスビュー位置認識位置認識2026/5/1
地上画像とLiDAR、航空画像を統合し、ODEベースの融合とVLAQを用いてクロスビュー位置認識の精度を大幅に向上させた。
- JoyAI-RA 0.1: ロボット自律性のための基盤モデルVLA2026/4/1
オープンワールドでのロボット操作の汎化を目指し、ウェブデータ、人間の操作動画、シミュレーション、実ロボットデータを統合したVLA基盤モデルJoyAI-RAを提案。実世界とシミュレーションで最先端性能を達成した。
- VoxelMapを用いた密結合LiDAR-慣性オドメトリの導出についてオドメトリ2026/3/1
本論文は、VoxelMap表現を用いた反復誤差状態カルマンフィルタ内での密結合LiDAR-慣性オドメトリの数学的定式化を簡潔に提示する。新しいアルゴリズムを提案するのではなく、一貫した表記と明示的な定式化を通じて幾何モデリングと確率状態推定を統合する自己完結的な導出を提供する。
- AtomicVLA: ロボットにおける原子スキル学習の可能性を解き放つVLA/操作/継続学習2026/3/1
長期的・多段階のロボット操作タスクを扱うため、タスク計画・原子スキル抽象化・細粒度アクションを統合的に生成するフレームワークAtomicVLAを提案。スキル誘導型Mixture-of-Expertsによりスケーラブルな原子スキルライブラリを構築し、継続学習も可能にした。
- TAG: 物体中心推論のためのターゲット非依存ガイダンスによるVLAポリシーの安定化VLA2026/3/1
VLAポリシーが散らかった環境で誤った物体や位置を掴む問題を、物体を消した観察との差分を利用した推論時ガイダンスで改善する手法を提案。
- RADAR: 実世界ダイナミクス・空間物理知能・自律評価による視覚言語行動モデルの汎化ベンチマークVLA2026/2/1
VLAモデルの実世界汎化を評価するため、物理ダイナミクス・空間推論タスク・3D指標による完全自律評価を統合したベンチマークRADARを提案し、既存モデルを監査した。
- 視覚言語行動モデルのための安定した言語ガイダンスVLA2026/1/1
VLAモデルが言語の言い回しの変化に弱い「モダリティ崩壊」を解決するため、意味意図と視覚的アフォーダンスを分離する確率的フレームワークRSSを提案し、敵対的な言語摂動下でも頑健な操作性能を実現した。
- DC-VLAQ: クエリ残差集約によるロバストな視覚的位置認識視覚的位置認識2026/1/1
DINOv2とCLIPの相補的特徴を残差補正で融合し、クエリへの残差応答で局所トークンを集約する視覚的位置認識フレームワークを提案。
- AgriLiRa4D: 厳しい農業環境でのロバストSLAMのためのマルチセンサUAVデータセットSLAM2025/12/1
農業用UAVのロバストなSLAM研究のために、3種類の農地と2つの運用モードでLiDAR・4Dレーダ・IMUを同期取得したマルチモーダルデータセットを構築し、最先端SLAM手法をベンチマークした。
- E0: Tweedie離散拡散によるVLAモデルの汎化性と細粒度制御の向上VLA2025/11/1
量子化された行動トークン上でTweedie離散拡散を行うVLAフレームワークE0を提案し、視点摂動拡張と合わせて多様な環境での汎化と細かい制御を実現した。
- マルチセンサフュージョンによる大規模UAVマッピングでの高速オルソ画像生成UAVマッピング2025/3/1
GPS・IMU・4Dミリ波レーダー・カメラを統合したUAVシステムで、事前姿勢最適化特徴マッチングにより低テクスチャな農地でも短時間で高精度なオルソ画像を生成する手法を提案した。