Peihao Chen
収録論文 10本 ・ フィジカルAI/ロボット学習
マニピュレーションワールドモデル身体性AIナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 3DFlowAction: 3Dフローワールドモデルから身体性を超えたマニピュレーションを学習マニピュレーション2025/6/1
人間とロボットの操作データから3D空間での物体の動きを予測するワールドモデルを学習し、言語指示に基づく3Dフローを生成してロボットの操作計画を導く手法を提案。
- 3D永続的具現化ワールドモデルの学習ワールドモデル2025/5/1
過去に生成した内容を明示的に記憶する3Dマップを条件付けし、RGB-D動画拡散モデルで長期的に一貫した未来予測を可能にする永続的ワールドモデルを提案。計画や方策学習に有効性を示す。
- 3D-Mem: 身体性エージェントのための3Dシーンメモリ身体性AI2024/11/1
探索領域を多視点画像の「メモリスナップショット」として記憶し、未探索領域の「フロンティアスナップショット」も活用することで、身体性エージェントの探索と推論を向上させる3Dシーンメモリを提案した。
- CoNav: 人間中心の協調ナビゲーションのためのベンチマークナビゲーション2024/6/1
人間の活動を観察して意図を推論し、人間より先に目的地へナビゲートする協調ナビゲーション(CoNav)ベンチマークを提案。LLMベースの人間動作生成と意図認識エージェントを開発した。
- 3D-VLA:3D視覚・言語・行動の生成的ワールドモデルVLA2024/3/1
3D知覚・推論・行動を生成的ワールドモデルで結びつけた基盤モデルを提案し、拡散モデルによる将来の画像・点群生成を通じて行動計画能力を向上させた。
- MultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World2024/1/1
- FGPrompt: Fine-grained Goal Prompting for Image-goal Navigation2023/10/1
- $A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models2023/8/1
- 3D-LLM: Injecting the 3D World into Large Language Models2023/7/1
- Learning Active Camera for Multi-Object Navigation2022/10/1