Wei Liu
Xpeng Inc.
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- IronViT: 効率的な汎用視覚表現学習に向けて視覚基盤モデル2026/9/24
複数の専門家モデルの能力をソフトマックス注意で統合してからハイブリッド線形注意エンコーダへ蒸留し、高解像度でも効率的な汎用視覚エンコーダを実現した。
- Behavior-Skill: 長期的タスクにおける視覚-言語-行動ポリシー評価のための細粒度ベンチマークVLA/ベンチマーク2026/8/31
長期的なモバイル操作タスクを構成するスキル単位で学習・評価するベンチマークを提案し、VLAポリシーの失敗箇所を詳細に分析できるようにした。
- GuardianBench:身体化AIにおける潜在的な文脈リスクのための同一シーン指示対比ベンチマーク安全性評価2026/8/22
同一シーンで指示だけを変えた安全/不安全の対比ペアからなるベンチマークを構築し、VLMが指示に鈍感で安全判断を誤ることを示し、軽量な事後学習手法で改善を実証した。
- 人間のデモから接触力ガイダンスを用いた器用操作の学習器用操作2026/7/1
人間のデモから物体に加わる力・トルク空間でガイダンスを作り、強化学習で長期的な器用操作を学習するフレームワークCHORDを提案。大規模ベンチマークで高い成功率を示し、実世界にも転移可能。
- 基盤モデルを用いたロボットの患者・高齢者ケアへの応用の探求ケアロボティクス2026/6/8
この論文は、基盤モデルを搭載したケアロボットの設計、ユーザー体験、ケア成果のエビデンスをレビューし、現状の限界と将来の研究方向性を提案している。
- ワールドモデル:アーキテクチャ、方法論、推論パラダイム、応用に関する包括的サーベイサーベイ2026/5/28
環境の構造とダイナミクスを学習する内部シミュレータであるワールドモデルについて、アーキテクチャ、方法論、推論戦略、応用領域の4軸で分類する包括的なサーベイを提供する。
- 複雑なカードゲームのための因果強化学習:マジック・ザ・ギャザリングのベンチマーク強化学習2026/5/7
因果強化学習のための複雑なベンチマークとして、マジック・ザ・ギャザリングを用いた環境を構築し、因果構造を活用するエージェントを提案・評価した。
- AcceRL: 視覚言語行動モデルのための分散非同期強化学習と世界モデルフレームワークVLA/強化学習2026/3/19
同期バリアと環境データ取得コストによるボトルネックを解消するため、環境ロールアウト・モデル推論・勾配更新を物理的に分離した分散非同期RLフレームワークを提案し、スループットとサンプル効率を大幅に向上させた。
- AGILE:ヒューマノイドの移動操作学習のための包括的ワークフローヒューマノイド/移動操作/sim2real2026/3/1
シミュレーションから実機への移行を容易にするため、環境検証から訓練、評価、展開までを標準化したヒューマノイド強化学習のエンドツーエンドワークフローAGILEを提案し、5つのスキルと2つのハードウェアで有効性を示した。
- Xiaomi-Robotics-0:リアルタイム実行可能なオープンソース視覚言語行動モデルVLA2026/2/1
大規模なロボット軌道と視覚言語データで事前学習し、非同期実行のための学習技術と展開時のタイムステップ調整により、民生用GPUで高速かつ滑らかなリアルタイム動作を実現したVLAモデルを提案。
- 内在的動機付けによる協調探索を用いたマルチロボット社会的地形ナビゲーション群制御2025/12/1
歩行者との共存環境で複数ロボットが隊形を保ちながら移動するため、内在的報酬による協調探索を導入した強化学習手法を提案し、ベンチマークで既存手法を上回る性能を示した。
- Rad-GS: 屋外環境における3DガウシアンスプラッティングSLAMのためのレーダー・視覚統合SLAM2025/11/1
4Dミリ波レーダーとカメラを統合し、3Dガウシアン表現を用いたキロメートル規模の屋外SLAMシステムを提案。ドップラー情報と幾何学的強化点群で動的物体をマスクし、大規模環境でのメモリ効率と再構成精度を向上させた。
- Isaac Lab:マルチモーダルロボット学習のためのGPU加速シミュレーションフレームワークsim2real2025/11/1
GPU並列物理演算とフォトリアル描画を統合し、強化学習・模倣学習を大規模に実行できるロボット学習用シミュレーションプラットフォームを提案。
- InterAct: 日常場面における2人間の動的で表現豊かなインタラクティブ活動の大規模データセットマルチモーダル相互作用2025/9/1
2人が日常場面で協力して行う長時間のインタラクティブな活動を、音声・身体動作・表情のマルチモーダルで収録した大規模データセットを構築し、音声から両者の表情と身体動作を生成する拡散モデル手法も提案した。
- MotionPersona: 個人特性を反映した歩行制御歩行2025/6/1
身体的特徴や心理状態などの属性を指定すると、それを反映した歩行アニメーションをリアルタイム生成するキャラクターコントローラを提案。
- X-Driver: 視覚言語モデルによる説明可能な自動運転自動運転/VLA2025/5/1
マルチモーダル大規模言語モデルとChain-of-Thought推論を組み合わせ、CARLAシミュレータ上の閉ループ自動運転でSOTA性能と解釈性を両立したフレームワーク。
- GraspCoT: 物理特性推論を統合した柔軟な言語指示による6自由度把持マニピュレーション2025/3/1
物理特性に着目したChain-of-Thought推論とマルチモーダルLLMを組み合わせ、多様な言語指示から6自由度把持姿勢を予測するフレームワークを提案し、新ベンチマークIntentGraspで有効性を示した。
- COMPASS: 残差強化学習とスキル統合によるクロスエンボディメント移動ポリシーsim2real2025/2/1
単一のロボットの模倣学習デモのみから出発し、残差強化学習で適応させ、エンボディメント埋め込みで一般化ポリシーに蒸留することで、多様な機体にまたがる移動を実現した研究。
- 自律ロボットのための適応的経路計画:UCH強化Q学習アプローチ経路計画2025/1/1
Qテーブル初期化を最適化するPACOと、動的調整パラメータを持つUCH機構で報酬関数を改善し、Q学習の探索効率と収束速度を高めるIQLフレームワークを提案した。
- LiV-GS: 屋外環境におけるLiDAR-視覚統合3DガウシアンスプラッティングSLAMSLAM2024/11/1
LiDARの点群と連続的な3Dガウシアンマップを共有共分散で直接整合させ、屋外大規模環境で高精度なSLAMと新規視点合成を7.98FPSで実現した手法。
- X-Mobility:世界モデリングによるエンドツーエンドの汎化可能なナビゲーションナビゲーション2024/10/1
潜在状態空間を持つ自己回帰的な世界モデルと多頭デコーダを組み合わせ、行動方策と分離して学習することで、未知環境でも汎化するナビゲーションモデルを実現した。
- UniMSF:高度交通システム向け統合マルチセンサ融合によるグローバル自己位置推定フレームワーク自己位置推定/マルチセンサ融合2024/9/1
GNSSや4Dレーダーなど異種センサを因子グラフで統合し、外れ値検出とオンライン雑音推定により、高度交通システムの高精度なグローバル自己位置推定を実現するフレームワークを提案した。
- 協調知覚オンデマンドによる状況認識型自動運転意思決定自動運転2024/9/1
都市道路での自動運転において、必要時のみ協調知覚を起動するCPoD戦略を提案し、POMDPとして定式化して安全かつ効率的な意思決定を実現した。
- Robot Crowd Navigation in Dynamic Environment with Offline Reinforcement Learning2023/12/1
- Spatio-Temporal Transformer-Based Reinforcement Learning for Robot Crowd Navigation2023/5/1
- Multi-level decision framework collision avoidance algorithm in emergency scenarios2023/4/1
- Coordinated Control of Path Tracking and Yaw Stability for Distributed Drive Electric Vehicle Based on AMPC and DYC2023/4/1
- A Systematic Survey of Control Techniques and Applications in Connected and Automated Vehicles2023/3/1
- Constrained Variational Policy Optimization for Safe Reinforcement Learning2022/1/1
- OCRTOC: A Cloud-Based Competition and Benchmark for Robotic Grasping and Manipulation2021/4/1
- Modeling Varying Camera-IMU Time Offset in Optimization-Based Visual-Inertial Odometry2018/10/1