Zhuoran Li
収録論文 6本 ・ フィジカルAI/ロボット学習
報酬設計全身移動/パルクール/強化学習VLA/ロバスト性/メモリモデルベース強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MLREF: 大規模言語モデルによる強化学習の報酬設計における効率的なモジュール再利用報酬設計2026/8/19
報酬関数をモジュール単位で進化させるフレームワークMLREFを提案し、再利用可能なモジュールプールを導入して報酬設計の安定性と性能を向上させた。
- 軽量ロコパルクール:マルチスキル蒸留による多用途な知覚全身移動全身移動/パルクール/強化学習2026/8/1
深度カメラと速度指令のみで、歩行・バランス・登攀・降下・跳躍などの全身スキルを自律的に切り替える単一のポリシーを提案し、障害物のある地形での移動を実現した。
- RoboHarness:メモリ拡張型ポリシーハーネスによる視覚言語行動モデルの文脈内適応ロバスト性向上VLA/ロバスト性/メモリ2026/3/1
凍結したVLAモデルを微調整なしでロバスト化するため、デュアルメモリRAGとマルチモーダルLLMによる帰属駆動オーケストレータ、MCP介入を備えたオンラインパイプラインと、オフラインのメモリ統合を提案し、平均成功率を56.6%向上させた。
- 再パラメータ化フローポリシー最適化モデルベース強化学習2026/2/3
フローポリシーをモデルベース強化学習に組み込み、生成過程とダイナミクスをまとめて誤差逆伝播することで、高いサンプル効率と安定性を実現した手法を提案。
- RoboEXP: Action-Conditioned Scene Graph via Interactive Exploration for Robotic Manipulation2024/2/1
- D$^3$Fields: Dynamic 3D Descriptor Fields for Zero-Shot Generalizable Rearrangement2023/9/1