Erhang Zhang
収録論文 3本 ・ フィジカルAI/ロボット学習
模倣学習動作予測VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人間のビデオからのロボット学習:サーベイ模倣学習2026/4/1
ロボットが人間の行動ビデオからスキルを獲得する手法を包括的にレビューし、タスク・観察・行動指向の転移経路とデータ基盤を整理したサーベイ論文。
- Uni-Hand: 一人称視点における汎用手動作予測動作予測2025/11/1
一人称視点の動画から、頭部と手の動きを拡散モデルで同時に予測し、手首・指先の2D/3D軌道や物体との接触状態まで推定する汎用手動作予測フレームワークを提案。
- 一人称視点動画におけるゼロショット時間的インタラクション定位VLA2025/6/1
一人称視点動画で人間と物体の把持動作のタイミングを、大規模視覚言語モデルと3D手の速度を活用してゼロショットで高精度に定位する手法EgoLocを提案した。