Xiangtai Li
収録論文 7本 ・ フィジカルAI/ロボット学習
視覚推論自動運転/評価ベンチマークVLA世界モデル歩行4D点群認識
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniVR: 視覚空間での思考による統合視覚推論視覚推論2026/7/14
純粋な視覚デモから複雑な推論、物理ダイナミクス、長期計画を同時に学習する最初の試みで、新しい強化学習手法と大規模ベンチマークを導入し、視覚空間内での推論の可能性を示した。
- あなたの運転ワールドモデルは万能選手か?自動運転/評価ベンチマーク2026/5/1
運転ワールドモデルの性能を画質から閉ループ運転まで多面的に評価する統一ベンチマークWorldLensを提案し、既存モデルが全軸で優れないことを示した。
- 自動運転のための視覚-言語-行動モデル:過去・現在・未来VLA2025/12/1
自動運転における視覚-言語-行動(VLA)フレームワークの進化を整理し、End-to-End型とDual-System型の2つのパラダイムに分類して、その特徴と課題を概観したサーベイ論文。
- マスクから世界へ:世界モデル構築のための実践ガイド世界モデル2025/10/23
初期のマスクモデルから統一アーキテクチャ、対話型生成モデル、記憶拡張システムへと至る世界モデル構築の道筋を、生成・対話・記憶の3要素に焦点を当てて解説する。
- 関節故障に耐える脚式ロボットの統合型レジリエント制御歩行2025/2/1
脚式ロボットの関節故障やセンサ故障に適応するため、マスキング機構を用いた2段階学習のモデルフリー制御フレームワークUMCを提案し、故障時のタスク達成率を平均36〜39%向上させた。
- VG4D: 視覚言語モデルを4D動画認識へ応用4D点群認識2024/4/1
視覚言語モデルの知識を4D点群エンコーダに転移し、改良したPSTNetで点群動画を効率的にモデル化することで、行動認識の精度を向上させた研究。
- Semantic Flow for Fast and Accurate Scene Parsing2020/2/1