Qian Wang
Yale University
収録論文 30本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- X2Real:実世界汎用ポリシー評価のための拡張可能なシミュレーションベンチマークsim2real2026/9/23
実機との相関0.84を達成したIsaac Labベースの進化型シミュレーションベンチマークで、10能力次元・44タスクにより汎用マニピュレーションポリシーを忠実・多様・公平に評価する。
- X-Planner: 身体性知能のためのイベント構造化タスクプランニングVLA2026/9/21
VLAシステムのためのプランニングフロントエンドX-Plannerを提案し、イベント構造化された計画形式と段階的デコーディングで長期的操作タスクの計画品質と実行性能を向上させた。
- サンプリングベースMPCによる視覚ポリシー学習の加速VLA2026/9/17
サンプリングベースのモデル予測制御と一次勾配ポリシー最適化を組み合わせ、深度画像から歩行・操作ポリシーを効率的に学習し、実機ロボットへゼロショット転移する手法を提案。
- 視覚・言語・行動を分離した効率的なマルチタスクロボット方策VLA2026/9/16
VLMを使わず視覚エンコーダ・言語エンコーダ・行動ヘッドを分離した方策を構築し、同等の成功率を保ちつつ推論速度と省エネ性を大幅に改善した。
- WALL-SS: 次スケール自己回帰による長期的世界モデルのスケーリング世界モデル2026/8/26
ロボットの視覚的未来予測をスケール単位の自己回帰で生成する世界モデルを提案し、行動制御可能で長期的なシミュレーションを実現した。
- Genie Sim PanoWorld: パノラマシーン生成とシミュレーションによる無限屋内3Dワールド生成パイプライン3Dシーン生成2026/7/29
単一の360度パノラマ画像から、自由に移動可能な高忠実度3Dシーンを再構築する2段階のフィードフォワードパイプラインを提案。軌道制御可能なパノラマ動画を生成し、それを3Dガウシアンシーンに変換することで、シミュレーション用アセットとして利用可能にする。
- ロボット基盤モデルにおける近道学習を軽減する人工中心窩知覚ロボット基盤モデル2026/7/1
ロボット基盤モデルがシーン内の無関係な相関に依存する「近道学習」を起こす問題を指摘し、タスク関連領域に注意を向けるマスクを生成する軽量モジュール(AFP)を提案。微調整時の補助信号として用いることで、モデルの性能とロバスト性を向上させる。
- RayViT: 視点変動に頑健な模倣学習のためのレイ条件付き視覚表現模倣学習2026/7/1
カメラの幾何情報を事前学習済みViTに注入する軽量アーキテクチャRayViTを提案し、カメラの摂動に対する模倣学習の頑健性を向上させた。
- VOID: 潜在拡散モデルにおける不正な模倣を打ち破る拡散モデル防御2026/6/10
潜在拡散モデルによる個人の不正な模倣を防ぐため、モデルの確率的挙動を操作して画像の意味構造を破壊する防御フレームワークVOIDを提案した。
- WALL-WM: イベント接合部での世界行動モデリングの彫刻VLA2026/6/1
WALL-WMは、ビデオ行動学習をチャンク中心の最適化からイベント基盤の視覚言語行動事前学習へと移行させ、意味的に一貫した行動イベントを学習の原子単位として使用する世界行動モデルです。
- 基盤モデル搭載ロボットのセキュリティとプライバシーに関する体系化セキュリティ/プライバシー2026/6/1
基盤モデルを搭載したロボットのセキュリティ・プライバシーリスクを、F-E-S-G(基盤モデル層、具現化システム層、支援エコシステム層、ガバナンス影響層)の4層構造フレームワークと多レベル分類法を用いて96件の論文を体系的に整理・分析した論文。
- Wall-OSS-0.5 技術報告書VLA2026/5/1
大規模VLA事前学習がロボットの実行可能な行動を直接生み出すかを検証し、ゼロショットで実ロボット動作を達成するオープンソース4Bモデルを提案した。
- 確率的分離ポリシー勾配による効率的なオンポリシー視覚強化学習強化学習/視覚2026/5/1
軌道ロールアウトのランダム摂動でポリシー勾配を推定し、単一GPUで数時間の学習を実現する軽量な視覚強化学習手法SDPGを提案。視覚MuJoCoベンチマークで既存手法より高速・低メモリ・高報酬を達成し、実機へのsim-to-real転送も実証した。
- XRZero-G0:インターフェース、品質、比率で器用なロボット操作の最前線を押し広げるデータ収集/模倣学習2026/4/1
ロボットを使わない人間のデモデータ収集システムXRZero-G0を提案し、閉ループの品質管理とデータ混合比率の最適化により、少量の実機データで大規模なロボットフリーデータと組み合わせて同等性能を達成し、コストを20分の1に削減した。
- PhysCodeBench: 自己修正型マルチエージェントによる3Dシーンの物理認識シンボリックシミュレーションのベンチマークシミュレーション2026/4/1
物理現象の自然言語記述を実行可能なシミュレーション環境に変換する能力を評価する初のベンチマークを構築し、専門エージェントが協調して物理的に正確なシミュレーションを生成する自己修正型マルチエージェントフレームワークを提案した。
- Genie Sim PanoRecon: 単一視点パノラマからの高速没入型シーン生成3D再構成/シミュレーション2026/4/1
パノラマ画像からロボット操作シミュレーション用の高品質3Dシーンを数秒で再構成するガウススプラッティング手法を提案。深度情報を活用した融合戦略で視点間の幾何学的整合性を確保し、LLM駆動のシミュレーションプラットフォームGenie Simに統合した。
- ManipArena:推論指向の汎用ロボットマニピュレーションの実世界包括評価マニピュレーション2026/3/1
実機ロボットでのマニピュレーション汎化を公平に評価するため、20タスク・1万超の専門家軌道・約188時間分のデータを備えた標準化ベンチマークを構築し、VLAやワールドアクションモデルなど7構成を比較した。
- Genie Sim 3.0:ヒューマノイドロボット向け高忠実度統合シミュレーションプラットフォームsim2real2026/1/1
LLMで自然言語から高忠実度シーンを生成し、VLMによる自動評価を可能にするロボットマニピュレーション用シミュレーションプラットフォームを提案。1万時間超の合成データセットを公開し、ゼロショットのsim-to-real転移を実証した。
- ロボットマニピュレーションのための1秒未満3Dメッシュ生成マニピュレーション2025/12/1
単一のRGB-D画像から、物体セグメンテーション・拡散モデルによるメッシュ生成・点群位置合わせを統合し、1秒未満でロボット操作に使える3Dメッシュを生成するシステムを提案。
- PointMapPolicy:マルチモーダル模倣学習のための構造化点群処理マニピュレーション2025/10/1
点群をダウンサンプリングせず規則的なグリッド状に構造化し、RGB画像と効率的に融合する拡散ポリシーを提案。複数の操作タスクで最先端性能を達成した。
- VLMを身体性空間へと点火する:WALL-OSSによる具現化基盤モデルVLA2025/9/1
大規模マルチモーダル事前学習を活用し、身体性を理解した視覚言語理解・言語と行動の連携・ロバストなマニピュレーションを統合したエンドツーエンドの具現化基盤モデルWALL-OSSを提案。
- BEAST: Bスプライン符号化による模倣学習向けアクション系列の効率的トークン化模倣学習2025/6/1
Bスプラインでアクション系列をコンパクトな離散・連続トークンに符号化するトークナイザを提案し、別途学習不要で滑らかな軌道生成と計算コスト削減を実現した。
- アフィン空間の網によるコヒーレンスベースの近似微分最適化2025/4/1
連続して計算される微分間の関連性(コヒーレンス)を利用し、少数の順伝播で勾配やヤコビ行列を高精度に近似するWASP最適化を提案し、ロボティクス最適化への応用も示した。
- ad-trait: Rustによる高速で柔軟な自動微分ライブラリ自動微分2025/4/1
Rustの浮動小数点型を演算子オーバーロードで拡張し、順方向・逆方向両対応の自動微分ライブラリを実装。SIMD活用で高速化し、ロボティクス最適化への応用も示した。
- X-IL: 模倣学習ポリシーの設計空間を探る模倣学習2025/2/1
模倣学習ポリシーの構成要素を自由に組み替えられるオープンソースフレームワークX-ILを提案し、設計空間を体系的に探索して既存手法を上回る新構成を発見した。
- MaIL: Mambaによる模倣学習の改善模倣学習2024/6/1
Transformerの代わりに状態空間モデルMambaを用いた模倣学習アーキテクチャMaILを提案し、少ないデータでも過学習を抑えて汎化性能を高め、LIBEROベンチマークと実機実験で有効性を示した。
- ヒューリスティック探索による学習済み局所MAPF方策の改善群制御2024/3/1
マルチエージェント経路探索において、機械学習による局所方策の出力確率分布にヒューリスティック探索を組み合わせることで、デッドロックを解消し、成功率とスケーラビリティを大幅に向上させた。
- Enhancing the Performance of DeepReach on High-Dimensional Systems through Optimizing Activation Functions2023/12/1
- Probabilistic Constraint Tightening Techniques for Trajectory Planning with Predictive Control2022/12/1
- Robot Learning via Human Adversarial Games2019/3/1