Jing Tang
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA生成デザイン
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DreamX-Phi 1.0: ロボット操作のための行動条件付きビデオワールドモデルVLA2026/8/1
観測フレームと言語指示、行動系列から将来の観測を予測するビデオワールドモデルを提案。アームの軌道忠実性と物体一貫性を保つため、幾何エンコーディングと深度・マスク情報を活用し、蒸留で高速化した。
- 見るために動き、動くために見る:拡散駆動の知覚-行動相互作用による適応的方策VLA2025/9/1
拡散方策のノイズ予測勾配を行動誘導SDEに組み込み、知覚と行動を循環的に学習させるDP-AGを提案。シミュレーションと実機UR5で既存手法を上回った。
- AutoDrive-R²: 自動運転VLAモデルの推論と自己反省能力を強化VLA2025/9/1
自動運転向けVLAモデルに思考連鎖と強化学習を導入し、推論と自己反省を促すことで軌道計画の精度と解釈性を向上させた研究。
- RoboLinker: 拡散モデルによる人間とコンパニオンロボットのペアルック生成生成デザイン2025/8/1
拡散モデルを使い、ロボットの画像とスタイル指示から、そのロボットの服装と調和する人間用の服を生成するシステムを提案。