Chenyou Fan
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA世界モデル/ベンチマークマルチエージェント計画ステレオマッチング両腕マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- V-JEPAポリシー:予測的視覚潜在表現上に構築する効果的な世界行動モデルVLA2026/9/29
凍結したV-JEPA 2.1エンコーダの潜在空間上に世界行動モデルを構築し、将来潜在予測器とフローマッチング行動エキスパートを下流で一括学習することで、LIBERO等で競争力のある性能を達成した研究。
- KineBench: IDM不要の運動学的接地による身体化世界モデルのベンチマーク世界モデル/ベンチマーク2026/7/1
身体化世界モデルの物理的整合性を評価するため、逆動力学モデルを使わずに生成動画から直接6Dエンドエフェクタ姿勢を抽出し、物理シミュレータで閉ループ検証する新しいベンチマークKineBenchを提案した。
- PRTS: 対比表現を用いたプリミティブ推論とタスク実行システムVLA2026/4/1
視覚言語行動モデルを、教師あり模倣学習ではなく目標条件付き強化学習として再構成し、言語指示を目標として扱うことで、物理的な到達可能性を評価する統一埋め込み空間を学習する基盤モデルを提案した。
- ELHPlan:マルチエージェント協調のための効率的な長期タスクプランニングマルチエージェント計画2025/9/1
LLMによるマルチロボット協調で、意図に紐づく行動系列を計画の基本単位とし、適応性と効率を両立させる長期プランニング手法を提案。トークン消費を従来の30〜40%に抑えつつ同等の成功率を達成した。
- 選択的Mixture-of-Expertsによる実世界でのロバストなステレオマッチング学習ステレオマッチング2025/7/1
視覚基盤モデルをLoRAとMixture-of-Expertsで効率的に適応させ、シーンに応じて専門家を選択することで、ドメインシフトに強いステレオマッチングを実現した。
- フローベース動画予測による汎用両腕基盤ポリシー両腕マニピュレーション2025/5/1
テキストからフロー、フローから動画への2段階ファインチューニングで動画予測を行い、軽量拡散ポリシーで両腕ロボットの行動を生成する基盤ポリシーを提案。