Shichao Fan
収録論文 6本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboAug: 領域対比データ拡張による単一アノテーションから数百シーンへのロボットマニピュレーションマニピュレーション2026/2/1
1枚の画像のバウンディングボックス注釈だけで生成モデルと領域対比損失を用いてデータ拡張を行い、ロボットマニピュレーションの汎化性能を向上させる手法を提案。
- RoboGene: 多様性駆動型エージェントフレームワークによる実世界タスク生成でVLA事前学習を強化VLA2026/2/1
多様で物理的に実現可能な操作タスクを自動生成するエージェントフレームワークを提案し、VLAモデルの事前学習データ収集を効率化して汎化性能を向上させた。
- RoboMIND 2.0:汎用身体知能のためのマルチモーダル両腕移動マニピュレーションデータセットマニピュレーション2025/12/1
6種類のロボットで集めた31万件超の両腕操作・移動マニピュレーション軌道(触覚・シミュレーション含む)を公開し、階層型VLM+VLAシステムMIND-2を提案した論文。
- XR-1: 統合視覚運動表現の学習による汎用視覚-言語-行動モデルVLA2025/11/1
視覚ダイナミクスとロボット運動を統合した離散潜在表現UVMCを二枝VQ-VAEで学習し、異種ロボットデータを横断する汎用VLAモデルXR-1を三段階学習で構築した研究。
- 拡散軌道誘導方策による長期的ロボットマニピュレーションマニピュレーション2025/2/1
拡散モデルで2D軌道を生成し模倣学習を誘導することで、長期的タスクでの誤差蓄積を抑え、CALVINベンチマークで成功率を25%向上させた研究。
- RoboMIND:ロボットマニピュレーションのためのマルチエンボディメント知能規範データセットマニピュレーション2024/12/1
4種類のロボットによる10.7万件の模倣学習用デモンストレーション軌道と失敗例、デジタルツイン環境を提供する大規模データセットを構築し、VLAモデルの性能を評価した。