Yiqi Tang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PreferenceFlow: 人間介入によるフローマッチングロボット方策のテスト時ガイダンスVLA2026/9/29
人間の介入とロボットの行動を比較して選好モデルを学習し、報酬なしで事前学習済みフローマッチング方策をテスト時に誘導する手法を提案。実機の精密挿入タスクで成功率を69%から90.5%に向上させた。
- 世界-価値-行動モデル:視覚言語行動システムのための暗黙的プランニングVLA2026/4/1
視覚言語行動(VLA)モデルに、将来の軌跡の潜在表現を学習し、価値関数で評価することで暗黙的プランニングを可能にする統一フレームワークを提案した。
- NFPO: 正規化フローによるロボットポリシー学習の安定化ポリシー最適化強化学習2026/3/1
ロボットの強化学習で、多峰性分布を表現できる正規化フローをポリシーとして用いる際の訓練不安定性を分析し、簡単な手法で安定化させて性能を向上させた。