Hengkai Pan
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA世界モデルワールドモデル模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EgoLAP: 言語-行動推論による一人称視点の人間データからの学習VLA2026/10/6
人間の一人称視点の軌道を、言語による行動連鎖推論を介してロボット制御に転移させるVLA事前学習フレームワークを提案し、実世界タスクで大幅な性能向上を達成した。
- ナノ・ワールドモデル:未来動画予測のミニマル実装世界モデル2026/5/17
拡散フォーシングを中心とした、将来のビデオ予測のためのコンパクトで再現可能なコードベースを提供し、世界モデルの設計選択を制御された方法で研究できるようにした。
- ViPRA: 動画予測によるロボット行動生成VLA2025/11/1
ラベルなし動画から将来の視覚観測と潜在行動を予測するモデルを事前学習し、少数の実演で連続ロボット制御を微調整するフレームワークを提案。
- DINO-WM: 事前学習済み視覚特徴量上のワールドモデルによるゼロショット計画ワールドモデル2024/11/1
DINOv2のパッチ特徴量を予測するワールドモデルをオフライン軌道から学習し、行動列最適化により未見タスクをゼロショットで計画する手法を提案。
- DynaMo: 視覚運動制御のためのドメイン内ダイナミクス事前学習模倣学習2024/9/1
専門家のデモンストレーションのみを用いて、潜在空間での逆ダイナミクスモデルと順ダイナミクスモデルを自己教師あり学習し、視覚表現を獲得する手法を提案。模倣学習の性能を向上させる。