Xuhong Wang
収録論文 5本 ・ フィジカルAI/ロボット学習
3Dシーン理解シミュレーション環境構築関節推定VLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GroupForward: インスタンスグループ化フィードフォワードガウシアンスプラッティングによる参照可能な3Dシーン構築3Dシーン理解2026/8/18
疎な多視点画像から3Dシーンの幾何・外観・インスタンス構造・意味を同時に再構成するフィードフォワード型の3Dガウシアンスプラッティングモデルを提案し、インスタンスグループ化により参照表現による複雑なシーン推論を可能にした。
- World2Minecraft: 占有駆動によるシミュレーションシーン構築シミュレーション環境構築2026/4/30
実世界のシーンを3Dセマンティック占有予測に基づいてMinecraft環境に変換する手法を提案し、データ収集パイプラインと大規模データセットMinecraftOccを導入して、占有予測の性能向上とカスタマイズ可能な具現化AI研究プラットフォームを実現した。
- DailyArt: 潜在ダイナミクスによる単一静止画像からの関節構造の発見関節推定2026/4/9
単一の閉じた状態の画像から、物体の関節パラメータを推定する新しい手法を提案。まず開いた状態の画像を合成して関節の手がかりを露出させ、観測画像との差分から全関節を同時に推定する。
- NaviMaster: GUIナビゲーションと身体性ナビゲーションを統合する統一ポリシーの学習VLA2025/8/1
GUI操作と身体性ナビゲーションを同一のMDPとして捉え、視覚的軌跡収集と強化学習で単一のエージェントを訓練し、両タスクで高性能を達成した。
- DORAEMON: 記憶強化型分散オントロジー認識エージェントによるナビゲーションナビゲーション2025/5/1
人間の脳の腹側・背側経路を模したフレームワークで、VLMと階層的意味空間融合・トポロジーマップを組み合わせ、未知環境でのゼロショット自律ナビゲーションを高精度に実現した。