Jialin Tian
Shanghai Jiao Tong University
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Track4Action: 世界中心の3Dトラッカーを視覚言語行動ポリシーに蒸留するVLA2026/8/1
行動ラベルにはロボットの動作指示しか含まれないが、デモ動画のフレーム遷移には3D世界の変化が含まれる。この遷移を凍結した3Dトラッカーから蒸留し、推論時にトラッカー不要のVLAポリシーを学習するフレームワークを提案。シミュレーションと実機で精度が向上した。
- ChronoFlow-Policy: 視覚運動ポリシー学習における過去・現在・未来の相互作用フローの統合VLA2026/6/1
物体とグリッパーの3Dキーポイントを用いて過去・現在・未来の相互作用ダイナミクスを統一的に表現するChronoFlowを導入し、これを拡散ベースの視覚運動ポリシーと共学習させることで、長期的・非マルコフ的操作タスクでの性能を向上させた。
- LaMP: 3Dシーンフローを潜在運動事前分布として用いる視覚-言語-行動ポリシーの学習VLA2026/3/1
3Dシーンフローを潜在的な運動事前分布として組み込んだ二重エキスパート型VLAフレームワークを提案し、LIBEROや実機実験で従来手法を上回る成功率とOOD頑健性を達成した。