Gerard Pons-Moll
収録論文 3本 ・ フィジカルAI/ロボット学習
動作理解/ベンチマークデータ生成ヒューマン・オブジェクト・インタラクション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NextMotionQA: 視覚言語モデルによる人間動作理解のベンチマークと評価動作理解/ベンチマーク2026/6/3
人間の動作理解を評価するための新しいベンチマークNextMotionQAを導入し、複数のタスクと難易度レベルで12の視覚言語モデルを評価して、その能力の限界を明らかにした。
- InHabit: 画像基盤モデルを活用したスケーラブルな3D人間配置データ生成2026/4/21
3Dシーンに人間を自然に配置する大規模データセットを自動生成する手法を提案。2D基盤モデルの知識を3Dに転写し、78Kサンプルのデータセットを構築した。
- FORCE: 物理特性を考慮した人と物体のインタラクション生成ヒューマン・オブジェクト・インタラクション2024/3/1
物体の質量や摩擦といった物理特性をモデル化し、人間の力と抵抗力の関係を捉えることで、多様でリアルな人と物体のインタラクション動作を生成する手法を提案。