Jie Chen
XPENG ROBOTICS
収録論文 33本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CGFM-Nav: 意味ガイド型生涯マルチモーダル具現化ナビゲーションのための認知グラフフィールドメモリナビゲーション2026/8/29
視覚言語ナビゲーションのための、明示的な関係メモリと連続的な空間直感を組み合わせた永続的なマルチモーダルシーン表現を提案し、目標検索と探索ガイダンスを統合したフレームワークを構築した。
- HODAgent:物理世界での人間との対話のためのオンデマンド・応答型ヒューマノイドヒューマノイド/サービスロボット2026/8/18
サービス現場のヒューマノイドロボット向けに、状況に応じた意図理解、応答実行、タスク修正、結果検証を統合したSystem-2エージェントを提案し、シミュレーションと実機で有効性を実証した。
- DeepInsight II: ベンチマークからロボットへの一つのトレース評価フレームワーク2026/8/17
物理AIスタックの評価を統一的に行うフレームワークを拡張し、ナビゲーションと操作のベンチマーク再現、全身制御のシミュレーションから実機への一貫した評価、そしてシステム間のハンドオフラベルと修復可能性の検証を行った。
- Capek 0.5: 実行中心の視覚言語モデルによる具現化知能VLA2026/8/7
ロボットの実行プロセスに着目し、空間推論・時間理解・行動誘導・状態検証の4つの能力を専門家モデルで学習し、統合する視覚言語モデルCapek 0.5を提案した。
- MiniWorld: ビデオワールドモデルのスクラッチ学習を民主化するビデオ生成2026/8/2
ビデオワールドモデルをスクラッチから効率的に学習するための軽量で再現可能なフレームワークMiniWorldを提案した。
- FlowPilot: 俊敏なUAVナビゲーションのためのリアルタイム世界行動モデリングUAVナビゲーション2026/8/1
深度画像から将来のシーンと軌道を同時に生成するコンパクトな世界行動モデルを提案し、シミュレーションと実機で高速・高機動な飛行を実現した。
- R2S-EGO: スパースキャプチャ実世界からシミュレーションへのデュアルプロキシ精緻化sim2real2026/8/1
ロボットの軌道に沿った視点を補完するため、シミュレータ由来のロボットプロキシとキャプチャ由来の幾何プロキシを組み合わせ、少ない実画像で実世界からシミュレーションへの変換精度を向上させる手法を提案した。
- Athena-Brain技術報告:汎用知能と身体化インタラクションのための効率的なロボット脳VLA2026/7/21
8B規模のLLMをロボットのオンデバイス脳として開発し、多段階のポストトレーニングにより汎用知能と身体化インタラクション能力を両立させた。
- Athena-WBC: 能力に合わせたポリシー専門家による長尾的人型全身制御全身制御2026/7/1
人型ロボットの全身運動追従制御において、訓練データの長尾部分(高ダイナミクス遷移やバランス重視動作)が解けない問題を、動作要求と訓練手法の能力ミスマッチと捉え、動的専門家とバランス専門家を備えた教師-学生パイプラインを提案し、少数の専門家でベースラインを上回る性能を達成した。
- DeepInsight: 物理AIスタック全体を統合する評価インフラストラクチャ評価基盤2026/6/16
物理AIスタック全体を単一のランタイムで評価できる統合インフラを提案し、異なるスケールやモダリティのタスクを共通の抽象化で扱えるようにした。
- ロボットをトークンとして:協調マルチロボット軌道生成のための統一拡散トランスフォーマー群制御2026/6/1
各ロボットをトークンとして扱う拡散トランスフォーマーを提案し、複数ロボットの軌道をフィードフォワードで直接生成する。個々の安全性と全体の接続性を満たす軌道を生成できる。
- 潜在誘導フローマッチングによる視覚言語行動ポリシーの改善VLA2026/6/1
視覚言語行動ポリシーに、成功可能性の軌跡を学習する自己誘導型フローマッチングを導入し、外部批評家なしで最良の行動選択を可能にする手法を提案した。
- マッピング認識型ワールドモデルによるアジャイルなクアッドローター飛行飛行制御2026/6/1
クアッドローターの視覚ベース飛行において、生画像再構成ではなく占有・可視性グリッドマップと自己運動を再構成する幾何学認識型ワールドモデルを提案し、シミュレーションと実機で有効性を示した。
- ROSClaw: 異種マルチエージェント協調のための階層的意味-物理フレームワークマルチエージェント2026/4/1
大規模言語モデルとロボットを統合し、異種ロボットの協調タスクを統一VLMコントローラで実行するフレームワークを提案。物理制約を考慮したsim-to-realマッピングとデータ収集機構により、長期的なタスク実行とポリシー最適化を実現する。
- 模倣を超えて:適応的拡散ナビゲーションポリシーのための強化学習ファインチューニングナビゲーション2026/3/1
拡散ベースのナビゲーションポリシーを強化学習(GRPO)でファインチューニングし、オフラインデータの限界を超えて未見環境での成功率と経路効率を向上させた。
- ImagiNav: 生成的視覚予測と逆動力学によるスケーラブルな身体化ナビゲーションナビゲーション2026/3/1
ロボットのナビゲーションを、言語指示を視覚的なサブゴールに分解し、生成ビデオモデルで未来の軌道を想像し、逆動力学モデルで軌道を抽出するというモジュール方式で実現。ロボットデータなしでゼロショット転移を達成する。
- 世界モデルの混合:モジュール型潜在ダイナミクスによるマルチタスク強化学習のスケーリングマルチタスクRL/世界モデル2026/2/1
タスクごとにモジュール化したVAEと専門家混合型Transformerで世界モデルを構成し、Atari 100kとMeta-Worldで高効率・高性能なマルチタスク強化学習を実現した。
- SwordRiding:未知の複雑環境におけるクアッドロータのためのオンライン誘導ベクトル場による統合ナビゲーションフレームワークナビゲーション2025/11/1
未知の複雑環境でクアッドロータを頑健にナビゲートするため、ESDFとBスプラインからオンラインで誘導ベクトル場を構築する閉ループ型の統合フレームワークを提案した。
- DiffAero: クアッドロータの効率的な方策学習のためのGPU加速微分可能シミュレーションフレームワークsim2real2025/9/1
GPU上で物理とレンダリングを完全並列化した軽量・微分可能なクアッドロータ用シミュレータを提案し、微分可能・ハイブリッド学習アルゴリズムの研究基盤を提供するとともに、民生ハードで数時間以内に堅牢な飛行方策を学習できることを実機実験で示した。
- SPGrasp: 動的シーンにおける時空間プロンプト駆動型把持合成マニピュレーション2025/8/1
動画ストリーム上でユーザープロンプトと時空間文脈を統合し、低遅延かつ時間的一貫性を保った把持姿勢をリアルタイム生成するフレームワークを提案。
- 状態レベルの軌道スティッチングによるロバストなオフライン模倣学習模倣学習2025/3/1
混合品質のオフラインデータから、状態ベースの探索で軌道断片を繋ぎ合わせ、多様で有益な訓練軌道を生成することで、模倣学習の汎化性能と成功率を向上させる手法を提案。
- 超大規模マルチロボットタスク計画のためのスケーラブルな階層型強化学習群制御2024/12/1
ロボット移動型フルフィルメントシステムにおける超大規模マルチロボットタスク計画に対し、階層型時間注意ネットワークと多段階カリキュラム、反事実ロールアウトベースラインを組み合わせた階層型強化学習プランナを構築した。
- 安全強化学習による障害物環境での時間最適飛行飛行制御2024/6/1
安全強化学習を用いて、障害物の多い環境でドローンをウェイポイントに沿って衝突回避しつつ最短時間で飛行させる手法を提案した論文。
- 自動運転を進化させる基盤モデルの展望自動運転2024/5/1
GPTやSoraなどの基盤モデルを自動運転に応用する可能性を整理し、シーン理解・推論、長尾データ拡張、World Modelによる運転環境生成と予測・学習への活用を展望したサーベイ。
- Learning Hybrid Policies for MPC with Application to Drone Flight in Unknown Dynamic Environments2024/1/1
- Efficient and Robust Time-Optimal Trajectory Planning and Control for Agile Quadrotor Flight2023/5/1
- TJ-FlyingFish: Design and Implementation of an Aerial-Aquatic Quadrotor with Tiltable Propulsion Units2023/1/1
- Composition and Application of Current Advanced Driving Assistance System: A Review2021/5/1
- Distributed Global Output-Feedback Control for a Class of Euler-Lagrange Systems2019/7/1
- A Frequency-Domain Characterization of Optimal Error Covariance for the Kalman-Bucy Filter2018/7/1
- GP-Localize: Persistent Mobile Robot Localization using Online Sparse Gaussian Process Observation Model2014/4/1
- Gaussian Process-Based Decentralized Data Fusion and Active Sensing for Mobility-on-Demand System2013/6/1
- Decentralized Data Fusion and Active Sensing with Mobile Sensors for Modeling and Predicting Spatiotemporal Traffic Phenomena2012/6/1