Haoran Xu
収録論文 9本 ・ フィジカルAI/ロボット学習
VLA3D再構築ワールドモデルシミュレーション環境構築マニピュレーションテレオペレーション世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AWM-VLA: 効率的で説明可能な視覚-言語-行動ポリシーのための整合された世界モデリングVLA2026/8/15
拡散トランスフォーマーポリシー内に未来の視覚-言語埋め込みと整合する未来トークンを組み込み、物体中心の予測も加えることで、長期的な結果を先読みしつつ説明可能なロボット操作を実現した。
- ReScene: マルチビューキャプチャからの構造化屋内シーン再構築3D再構築2026/6/26
マルチビュー画像から物理的に整合性のある構造化3Dシーンを再構築するフレームワークを提案し、幾何・画質・知覚品質で最先端を達成した。
- ループ型ワールドモデルワールドモデル2026/6/16
パラメータ共有のトランスフォーマーブロックを反復適用して潜在状態を精緻化する、初のループ型ワールドモデルを提案。従来比100倍のパラメータ効率と適応的計算量を実現し、反復的な潜在深度を新たなスケーリング軸として確立した。
- World2Minecraft: 占有駆動によるシミュレーションシーン構築シミュレーション環境構築2026/4/30
実世界のシーンを3Dセマンティック占有予測に基づいてMinecraft環境に変換する手法を提案し、データ収集パイプラインと大規模データセットMinecraftOccを導入して、占有予測の性能向上とカスタマイズ可能な具現化AI研究プラットフォームを実現した。
- 人間らしい事前知識を活用したアフォーダンス認識型ロボット巧み把持マニピュレーション2025/8/1
人間の手の動きを模倣した事前学習と、機能的に不適切な接触領域を避けるアフォーダンス認識モジュールを組み合わせ、自然で汎用的な巧み把持を実現するフレームワークAffordDexを提案。
- TeleOpBench:双腕巧みなテレオペレーションのためのシミュレータ中心ベンチマークテレオペレーション2025/5/1
双腕巧みなテレオペレーションの4つの方式(モーションキャプチャ、VR、外骨格、単眼視覚追跡)を30の高忠実度タスクで公平に比較評価するシミュレータベンチマークを提案し、実機実験との相関を確認した。
- デルタトライプレーン・トランスフォーマー:占有世界モデル世界モデル2025/3/1
自動運転向けに、3D占有の変化をトライプレーン表現で効率的に予測する新しい世界モデルを提案し、従来比1.44倍の高速化と精度向上を実現した。
- PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning2023/5/1
- When Data Geometry Meets Deep Function: Generalizing Offline Reinforcement Learning2022/5/1