Fangqi Zhu
収録論文 6本 ・ フィジカルAI/ロボット学習
世界モデルVLA/オフラインRL3D生成/サーベイVLAワールドモデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OnlineWM: 因果性を考慮した能動的オンライン学習による効果的な世界モデリング世界モデル2026/9/20
シミュレータと能動的に対話しながら、モデルの弱点を狙ったデータを収集し、反事実学習で行動と状態遷移の因果関係を捉える世界モデルのオンライン学習フレームワークを提案。
- RedFlow: 失敗をアクションレベルの修正へと変換するフローマッチングVLAポリシーVLA/オフラインRL2026/7/1
フローマッチングVLAポリシー向けに、失敗データをアクションレベルの修正信号に変換するオフライン強化学習フレームワークRedFlowを提案。実世界成功率を56.7%から74.7%に向上させた。
- 具身AIとロボットシミュレーションのための3D生成:サーベイ3D生成/サーベイ2026/4/1
本論文は、具身AIとロボットシステムにおける3D生成の役割を、データ生成、シミュレーション環境構築、Sim2Real橋渡しの3つの観点から整理したサーベイである。物理的整合性やインタラクション対応など、視覚的リアリズムを超えた要件に焦点を当て、現状の課題を分析している。
- HALO: 身体性マルチモーダル連鎖推論のための統合視覚-言語-行動モデルVLA2026/2/1
テキスト推論・視覚的サブゴール予測・行動予測を統合したEM-CoT推論を可能にするVLAモデルHALOを提案し、シミュレーションと実環境でベースラインを上回る性能を示した。
- WMPO:世界モデルに基づく視覚-言語-行動モデルの方策最適化VLA2025/11/1
実環境と相互作用せずにピクセルベースの世界モデル上でVLAモデルを強化学習し、自己修正などの創発行動やサンプル効率の向上を実現した。
- IRASim: ロボットマニピュレーションのための細粒度ワールドモデルワールドモデル2024/6/1
拡散トランスフォーマーとフレーム単位の行動条件付けモジュールを導入し、ロボットと物体の細かな相互作用を捉えた動画を生成するワールドモデルを提案。方策評価の加速やモデルベース計画による性能向上を実証した。