Fangneng Zhan
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAワールドモデル能動的3D再構成姿勢推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GEM-4D: ロボット操作のための幾何学強化ビデオワールドモデルVLA2026/5/1
ビデオ生成モデルに4次元対応関係の教師信号を注入し、外観と幾何構造を同時に学習させることで、物理的に一貫した未来予測とロボット操作への直接適用を可能にした。
- 流れ同変ワールドモデル:部分観測動的環境のための記憶ワールドモデル2026/1/3
自己運動と物体運動に応じて潜在記憶を同変的に移動・変換することで、部分観測下でも長期的な動力学予測を安定かつ高精度に行うワールドモデルを提案した。
- AREA3D: フィードフォワード3D知覚と視覚言語誘導を統合した能動的再構成エージェント能動的3D再構成2025/12/1
フィードフォワード型3D再構成モデルと視覚言語モデルを組み合わせ、不確実性推定と意味的誘導に基づいて視点を自律選択する能動的3D再構成エージェントを提案。
- RoboTAG: トポロジカルアラインメントグラフによるエンドツーエンドのロボット姿勢推定姿勢推定2025/11/1
単眼RGB画像からロボットの姿勢を推定するため、2Dと3Dの表現を協調進化させるトポロジカルアラインメントグラフを提案し、ラベルデータへの依存を軽減した。