Qiwei Li
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA身体化AI/データセットVLA/世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SplineWAM: Bスプライン表現によるワールドアクションモデルの適応的行動ホライズンVLA2026/9/30
行動軌道を3次Bスプラインで圧縮し、動作の複雑さに応じて行動チャンクの時間解像度と長さを適応的に変えるワールドアクションモデルを提案。推論呼び出しを削減しつつ成功率を向上させた。
- Xiaomi-Robotics-U0: 世界基盤モデルによる統合的身体性合成VLA2026/7/1
ロボットの身体性を考慮した画像・動画生成を統合する380億パラメータのマルチモーダル自己回帰モデルを提案し、マルチビュー一貫性やロボットの身体制約を保ちながら、シーン生成や転移、動画生成を高品質で実現した。
- RotVLA: 回転潜在アクションを用いた視覚言語行動モデルVLA2026/5/1
連続的な回転群SO(n)上の潜在アクション表現を導入し、離散量子化の問題を解決したVLAモデルを提案。大規模データで事前学習し、下流タスクで高い性能を達成。
- 身体化質問応答を認識から意思決定へ拡張する身体化AI/データセット2026/5/1
身体化環境での認識・推論・相互作用を統合評価する大規模データセットEQA-DecisionとベースラインモデルRoboDecisionを提案した論文。
- 非同期ノイズ除去によるビデオ事前学習を活用した統合4D世界行動モデリングVLA/世界モデル2026/4/1
ロボットのリアルタイム行動実行と高忠実度な4D世界生成(ビデオ+3D再構成)を単一フレームワークで統合するX-WAMを提案し、非同期ノイズサンプリングにより行動効率と生成品質を両立した。
- ProgressVLA: 進捗ガイド付き拡散ポリシーによる視覚言語ロボット操作VLA2026/3/1
ロボット操作のための視覚言語行動モデルに、タスク進捗の推定と微分可能な進捗ガイダンスを導入し、長期的なタスクでの成功率と汎化性能を向上させた。