Yingkai Cai
Tsinghua University
収録論文 2本 ・ フィジカルAI/ロボット学習
ロボット学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ワールドアクションモデルのための選択的クロスビュー整合性:テスト時カメラ情報なしでの未見視点ロバスト性ロボット学習2026/8/7
ロボットの行動生成モデル(ワールドアクションモデル)において、カメラ視点が変わっても動作が安定するよう、視点に依存しない座標だけに整合性損失を適用する手法を提案し、未見の視点での成功率を向上させた。
- カメラロバストな視覚言語行動ポリシーのためのクロスビュー行動整合性VLA2026/8/1
カメラ位置が変わっても動作が安定するよう、フローベースのVLAポリシーにクロスビュー損失を導入し、同一状態から異なる視点でレンダリングしたペアで行動フローの速度場を一致させる手法を提案。LIBEROベンチマークでカメラ摂動時の成功率を大幅に向上させた。