Cheng Chen
XPENG Robotics
収録論文 6本 ・ フィジカルAI/ロボット学習
所属歴(論文より): XPENG Robotics(〜2026) / Zhiyuan Innovation (Shanghai) Technology Co., Ltd.(〜2026)
VLA世界モデル/操作シーングラフ協調知覚/3D占有予測敵対的攻撃/防御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- XPACE: 異種経験からの世界モデルと行動モデルの統合学習VLA2026/9/15
人間とロボットの多様な経験を動画予測で結びつけ、行動予測と世界シミュレーションを同時に行う統合モデルを提案し、ヒューマノイドロボットで人間の技能をロボット未経験タスクへ転移できることを示した。
- AnyWorld: 因子分解された自己中心的世界モデルによるクロス身体汎化世界モデル/操作2026/8/29
人間の単一インタラクション動画を、ロボット固有の多様なロールアウトに拡張する世界モデルフレームワークを提案。行動・カメラ・身体の因子に分解し、身体・視点・シーンの再構成を可能にする。
- OVIP-SG: 小さな細粒度オブジェクトのマッピングと検索のためのオープンボキャブラリ・インスタンス保存シーングラフシーングラフ2026/8/18
オープンボキャブラリ知覚を3Dシーングラフに統合する際のインスタンス断片化問題を解決し、小さなオブジェクトの保存と機能的なシーン分割、言語ガイドによる検索を実現する統一フレームワークを提案した。
- SwiftVLA:軽量VLAモデルのための時空間ダイナミクスを最小オーバーヘッドで解き放つVLA2025/12/1
軽量な視覚言語モデルに4D特徴を融合トークンとマスク再構成で組み込み、推論時には4D入力を不要にして高速・省メモリで高性能なVLAモデルを実現した。
- 協調的セマンティック占有予測のためのビジョンのみのガウシアンスプラッティング協調知覚/3D占有予測2025/8/1
視覚情報のみを用い、スパースな3Dセマンティックガウシアンプリミティブを車車間で共有・融合することで、通信量を抑えつつ協調的な3Dセマンティック占有予測を高精度に実現する手法を提案した。
- 自動運転システムにおける敵対的知覚攻撃と防御手法の再検討敵対的攻撃/防御2025/5/1
自動運転システムの知覚モデルに対する敵対的攻撃と防御手法を、OpenPilotとYOLOを用いて道路標識認識と先行車両検出・予測の観点から体系的に評価した研究。