Kang Chen
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LaWAM: 効率的なダイナミクス認識ロボットポリシーのための潜在世界行動モデルVLA2026/6/1
ロボットの行動がシーンをどう変えるかを予測する潜在空間の世界モデルを導入し、ピクセル単位の動画生成を避けつつ、高成功率と低遅延を実現した。
- STEAM: 実世界ロボット学習のための自己教師あり時間アンサンブル優位性モデリングロボット学習2026/6/1
専門家のデモからフレーム間の時間オフセットを自己教師ありで学習し、ロールアウトデータの各フレームの優位性を評価する手法を提案。混合品質データの保守的なスコアリングにより、ポリシー学習の成功率を向上させた。
- 模倣を超えて:VLAモデルのための強化学習ベースのSim-Real協調学習VLA2026/2/1
実機とシミュレーションのデモでSFT後、シミュレーションで強化学習しつつ実機データの補助損失で忘却を防ぐ協調学習フレームワークを提案し、実機卓上操作タスクで成功率と汎化性能を向上させた。
- π_RL: フローベース視覚言語行動モデルのオンライン強化学習ファインチューニングVLA2025/10/29
フローマッチングに基づく大規模VLAモデルに強化学習を適用するため、Flow-NoiseとFlow-SDEの2手法を提案し、分布内外で性能を向上させた。
- RLinf-VLA:視覚言語行動モデルの強化学習のための統合効率フレームワークVLA2025/10/1
多様なVLAモデルとRLアルゴリズム、シミュレータを統合し、効率的な強化学習を可能にするフレームワークを提案。LIBEROやManiSkillなどで高い成功率を達成。
- TODE-Trans: Transparent Object Depth Estimation with Transformer2022/9/1
- What You See is What You Grasp: User-Friendly Grasping Guided by Near-eye-tracking2022/9/1