Qiyang Li
収録論文 9本 ・ フィジカルAI/ロボット学習
RL/遅延対応強化学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 待ち時間に学習する:推論遅延下での汎用ロボットポリシーのRLファインチューニングRL/遅延対応2026/8/24
推論遅延がRLのマルコフ性を壊す問題に対し、非同期推論と状態拡張で遅延を隠蔽しつつRL改善を可能にするフレームワークARLIを提案。シミュレーションと実機で有効性を実証した。
- 随伴マッチングによるQ学習強化学習2026/1/1
拡散・フローマッチング方策をQ関数で効率的に最適化するため、随伴マッチングを活用したTDベース強化学習手法QAMを提案し、疎な報酬タスクで従来法を上回る性能を示した。
- 分離型Qチャンキング:批評家と方策のチャンク長を分離した強化学習強化学習2025/12/1
批評家のチャンク長と方策のチャンク長を分離し、短い行動チャンクで方策を最適化することで、長期的な目標条件付きタスクにおけるオフライン強化学習の性能を向上させる手法を提案した。
- アクションチャンキングを用いた強化学習強化学習2025/7/1
将来の行動列をまとめて予測するアクションチャンキングをTDベースの強化学習に導入し、長期的で報酬が疎なタスクにおける探索とサンプル効率を改善するQ-chunkingを提案した。
- RLDG: 強化学習によるロボット汎用方策の蒸留マニピュレーション2024/12/1
強化学習で生成した高品質なデータを用いて汎用ロボット方策を微調整する手法を提案し、人間のデモより最大40%高い成功率を達成した。
- 視触覚データを用いた双腕多指ハンドによる技能学習マニピュレーション2024/4/1
低コストな双腕多指ハンドの遠隔操作システムHATOを開発し、触覚センサ付き義手を転用して視触覚データを収集、長期的で高精度なタスクを学習させた。
- Building a Winning Self-Driving Car in Six Months2018/11/1
- Learning of Coordination Policies for Robotic Swarms2017/9/1
- Deep Neural Networks for Improved, Impromptu Trajectory Tracking of Quadrotors2016/10/1