Gang Hua
収録論文 7本 ・ フィジカルAI/ロボット学習
3D物体検出単眼3D物体検出マニピュレーションLLMエージェントナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CoIn3D:構成不変なマルチカメラ3D物体検出の再考3D物体検出2026/3/1
マルチカメラ3D物体検出モデルが未知のカメラ構成にうまく一般化できない問題を解決するため、空間事前情報を明示的に組み込んだCoIn3Dフレームワークを提案した。
- 物体・シーン・カメラの分解と再構成によるデータ効率的な単眼3D物体検出単眼3D物体検出2026/2/1
訓練画像を物体・背景・カメラ姿勢に分解し、毎エポックで新たな組み合わせの画像を再構成することで、単眼3D物体検出モデルのデータ効率と汎化性能を高める手法を提案。
- DynaRend: マスク付き未来レンダリングによるロボットマニピュレーションのための3Dダイナミクス学習マニピュレーション2025/10/1
多視点RGB-D動画からマスク再構成と未来予測を微分可能ボリュームレンダリングで行い、3D形状・意味・ダイナミクスを統合したトライプレーン表現を自己教師あり学習するフレームワーク。RLBenchやColosseum、実機実験でマニピュレーション性能と汎化性を向上。
- WebATLAS: 経験駆動型メモリと行動シミュレーションを備えたLLMエージェントLLMエージェント2025/10/1
LLMウェブエージェントが未知のウェブ環境に適応できるよう、経験駆動型メモリと先読み行動シミュレーションを組み合わせたWebATLASを提案し、WebArena-Liteで成功率63%を達成した。
- RSRNav: 画像ゴールナビゲーションのための空間関係推論ナビゲーション2025/4/1
ゴール画像と現在の観測間の空間的関係を推論し、ナビゲーションの指針とする手法を提案。視点の不一致に強く、ベンチマークで優れた性能を示す。
- UGG: Unified Generative Grasping2023/11/1
- Evidential Active Recognition: Intelligent and Prudent Open-World Embodied Perception2023/11/1