Jiale Yu
収録論文 4本 ・ フィジカルAI/ロボット学習
ロボット制御VLA強化学習報酬設計
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HarmoWAM: 適応的世界行動モデルによる汎用性と精密操作の調和ロボット制御2026/5/1
世界行動モデル(WAM)の2つのパラダイム間のトレードオフを解消するため、予測と反応の2つの専門家を世界モデルで統合し、適応的ゲーティングで切り替えるエンドツーエンドのWAMを提案した。
- LaST₀:ロボット視覚言語行動モデルのための潜在時空間チェーン・オブ・ソートVLA2026/1/1
言語ではなく潜在空間で未来の視覚・3D・固有感覚を推論する時空間Chain-of-Thoughtを導入し、低頻度推論と高頻度行動生成を分離した二重システムVLAフレームワークを提案。
- SimpleVLA-RL:強化学習によるVLAモデル訓練のスケーリングVLA2025/9/1
VLAモデル向けの効率的な強化学習フレームワークを提案し、大規模データへの依存を減らしつつLIBEROやRoboTwinで高性能を達成した。
- GROVE: オープン語彙の身体スキルを学習するための汎用報酬強化学習報酬設計2025/4/1
LLMとVLMを組み合わせて報酬を自動生成し、手設計や実演なしで多様な身体スキルを学習できる汎用報酬フレームワークを提案。