Kaiyan Zhang
Tsinghua University
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA再帰的自己改善
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 統一軌道マッチング方策最適化:多様なT2I生成とVLA汎化VLA2026/9/28
拡散・フローポリシーの事後学習において、報酬最大化ではなく軌道分布マッチングを行う統一RLフレームワークUni-TMPOを提案し、T2I生成の多様性とVLAのタスク・シーン汎化を両立させた。
- 人類が最後に作るAI:真の再帰的自己改善に向けて再帰的自己改善2026/9/10
再帰的自己改善(RSI)の概念と発展ロードマップを提示し、科学発見・身体知能・ソフトウェア工学などのシナリオでの要件を検討して、実用的なシステムとの接続や課題を整理した論文。
- SimpleVLA-RL:強化学習によるVLAモデル訓練のスケーリングVLA2025/9/1
VLAモデル向けの効率的な強化学習フレームワークを提案し、大規模データへの依存を減らしつつLIBEROやRoboTwinで高性能を達成した。