Fangzhou Hong
収録論文 6本 ・ フィジカルAI/ロボット学習
一人称視点/道具使用推論ベンチマーク3D生成シミュレーション/再構築VLAsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EgoTools: 実世界の一人称視点動画における道具中心の推論に向けて一人称視点/道具使用推論2026/9/30
道具を使う一人称視点動画の大規模データセット(100時間)と、知覚・幾何・手順・因果推論を問う1,000問のベンチマークを構築し、既存の動画マルチモーダルモデルが道具使用の理解に苦戦することを示した。
- SpatialBench:あなたの空間基盤モデルは万能選手か?ベンチマーク2026/5/26
空間基盤モデルの真の汎化能力を評価するため、多様な領域・タスク・入力密度をカバーする大規模ベンチマークSpatialBenchを構築し、41モデルを体系的に評価した。
- PhysX-Omni: 剛体・変形体・関節物体のための統合シミュレーション対応物理3D生成3D生成2026/5/1
剛体、変形体、関節物体など多様なアセットタイプに対応した、シミュレーション対応の物理3D生成の統合フレームワークを提案した論文。
- HSImul3R: 物理を組み込んだシミュレーション可能な人-シーン相互作用の再構築シミュレーション/再構築2026/3/1
カジュアルな映像から、物理的に安定したシミュレーション可能な人-シーン相互作用の3D再構築を行うフレームワークを提案。物理シミュレータを能動的な監督者として双方向に最適化し、実ロボットへの適用も実証した。
- DynamicVLA:動的物体操作のための視覚-言語-行動モデルVLA2026/1/1
動的物体操作のためのVLAフレームワークを提案し、時系列推論と閉ループ適応を統合。合成・実世界データからなるDOMベンチマークも構築した。
- PhysX-Anything: 単一画像からシミュレーション可能な物理的3Dアセットを生成sim2real2025/11/1
単一の画像から、関節構造や物理属性を備えたシミュレーション可能な3Dアセットを生成するVLMベースのフレームワークを提案し、新データセットPhysX-Mobilityも構築した。