Wenwu Zhu
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AerialDojo-200K:オープンワールド航空物体目標探索のための大規模ベンチマークスイート航空探索2026/9/28
航空エージェントが大規模3D環境を自律探索し、意味記述や参照画像で指定された物体に到達するタスクのための、既存比3倍のシーンと18.7倍のタスクを含む大規模ベンチマークを構築した。
- 自己進化型ワールドモデルのための反事実的制御可能性を備えた自律ビデオ生成ワールドモデル2026/6/23
ビデオ生成モデルを自己進化型ワールドモデルへ発展させるため、介入条件付き未来生成、身体性制約への結合、分布シフト下での検証、生存ブランチの蒸留からなる4段階閉ループ最適化と対応する評価指標を提案した。
- WorldArena 2.0:モダリティ・機能・プラットフォームにわたる身体化ワールドモデルベンチマークの拡張ベンチマーク2026/5/1
身体化ワールドモデルの評価を、視覚のみから視触覚へ、政策評価から強化学習環境としての利用へ、シミュレータから実ロボットへと拡張したベンチマークを提案した。
- WorldArena:身体性世界モデルの知覚と機能的実用性を評価する統合ベンチマーク世界モデル2026/2/1
身体性世界モデルを映像知覚品質と下流タスクでの機能的実用性の両面から評価する統合ベンチマークWorldArenaを提案し、14モデルの実験から知覚と機能の間に大きなギャップがあることを示した。
- 3D空間における長期的視覚生成とナビゲーションのための航空世界モデルナビゲーション2025/12/1
UAVのナビゲーション向けに、過去のフレームと行動から将来の視覚観測を予測する世界モデルANWMを提案し、候補軌道を意味的妥当性で評価することで大規模3D環境での自律飛行性能を向上させた。
- U2UData+:身体的長期タスク向けスケーラブルな群UAV自律飛行データセット群制御2025/9/1
15機のUAVによる群自律飛行で長期依存や動的な目標変化を扱う身体的長期タスク向けの大規模データセットと、オンライン収集・閉ループ検証プラットフォームを構築した。
- 身体性AI:LLMから世界モデルへ身体性AI2025/9/1
大規模言語モデル(LLM)と世界モデル(WM)が身体性AIをどのように推進するかを、基礎から最新動向まで包括的にサーベイした論文。
- 空間ポリシー:空間認識モデリングと推論による視覚運動ロボット操作の誘導マニピュレーション2025/8/1
空間認識能力を欠く既存の視覚中心階層型モデルを改善するため、空間条件付き動画生成とフロー型行動予測、空間推論フィードバックを統合した操作フレームワークを提案し、23タスクで大幅な性能向上を達成した。
- EvolvingAgent: 長期タスクのためのカリキュラム自己進化エージェントと継続的世界モデルVLA2025/2/1
人間の介入なしに自己計画・自己制御・自己反省を通じて長期タスクを遂行するエージェントを提案し、LLMとマルチモーダル経験を活用した計画、世界モデルに基づく行動制御、カリキュラム学習による反省機構を統合した。
- U2UData: 群ロボットUAVの自律飛行のための大規模協調知覚データセット群制御2024/8/1
3機のUAVが自律飛行して収集したLiDAR・RGB・深度データと3Dアノテーションを含む、群UAV協調知覚のための初の大規模データセットを構築し、協調3D物体検出・追跡のベンチマークを提供した。