Fanfan Liu
収録論文 5本 ・ フィジカルAI/ロボット学習
ナビゲーションVLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboTron-Nav: 知覚・計画・予測を統合した具現化ナビゲーションの統一フレームワークナビゲーション2025/3/1
言語指示に基づく視覚ナビゲーションのため、知覚・計画・予測をマルチタスク学習で統合し、適応的な3D履歴サンプリングで過去の観測を効率的に活用するフレームワークを提案。CHORES-Sベンチマークで成功率81.1%を達成し、最先端性能を更新した。
- 低コストデータでロボットマニピュレーションの汎化を促進VLA2025/3/1
大規模作業空間での空間推論フェーズに着目し、低コストで収集可能なデータを活用してVLAモデルの汎化性能を高めるフレームワークを提案。
- RoboTron-Mani:ロボット操作のためのオールインワン・マルチモーダル大規模モデルマニピュレーション2024/12/1
カメラパラメータと占有監督で3D知覚を強化し、モダリティ分離マスクとマルチモーダルデコーダで融合を改善したロボット操作モデルと、複数データセットを統合したRoboDataを提案。CALVINで平均系列長を1.7から3.5に向上させ、シミュレーションと実世界で最先端を達成。
- RoboCAS:複雑な物体配置シナリオにおけるロボットマニピュレーションのベンチマークマニピュレーション2024/7/1
散在・整列・積み重ねなど複雑な物体配置を扱うロボット操作ベンチマークRoboCASを提案し、長期的な空間推論や連鎖反応予測の能力を評価した。
- RoboUniView: ロボット操作のための統一視点表現を持つ視覚言語モデルVLA2024/6/1
カメラパラメータに依存しない統一視点表現を事前学習で獲得し、それに基づいてロボット操作の行動を生成することで、異なるロボットプラットフォーム間での性能差を解消した手法を提案。