Han Zhou
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーション自動運転/VLAVLA模倣学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボストラル・ナビゲート:単眼RGBのみで動作するスケーラブルな視覚言語ナビゲーションモデルナビゲーション2026/7/1
単眼RGB画像のみを入力とし、画像空間上でウェイポイントを予測することで、様々なロボット形態に再較正なしで適用可能な8B視覚言語モデルを提案。大規模シミュレーションデータと効率的な学習手法により、実世界データへの依存を低減しつつ高性能を実現した。
- RT-VLA: 知識蒸留によるリアルタイム視覚言語行動モデル自動運転/VLA2026/6/12
大規模なVLAモデルの推論遅延を解決するため、教師モデルSimLingoから知識蒸留で軽量な学生モデルRT-VLAを構築し、推論時間を大幅に削減しつつ運転性能と言語推論を維持する手法を提案した。
- Skypilot: 物理的接地を取り入れたLLM微調整によるAAVカバレッジ探索VLA2025/11/1
モンテカルロ木探索と物理に基づく報酬を組み合わせてLLMを物理世界に接地させ、Qwen3-4Bを微調整することで、自律飛行体のカバレッジ探索を効率化した二段階フレームワーク。
- Traj2Action: 軌道ガイドによる人間からロボットへのスキル転移のための協調デノイジングフレームワーク模倣学習2025/10/1
人間の手の3D軌道を中間表現として用い、粗い軌道生成とロボット固有の行動合成を協調デノイジングで行うことで、形態差を超えた人間からロボットへの操作スキル転移を実現するフレームワークを提案。
- NeSyPack: 双腕ロジスティクス梱包のためのニューロシンボリックフレームワークマニピュレーション2025/6/1
データ駆動モデルと記号推論を組み合わせ、双腕ロボットによる物流梱包作業を階層的に分解して実行するニューロシンボリックなフレームワークを提案。ICRA 2025のWBCD競技会で優勝した。
- Time-Efficient Mars Exploration of Simultaneous Coverage and Charging with Multiple Drones2020/11/1