Hongzhi Zang
収録論文 5本 ・ フィジカルAI/ロボット学習
実世界オンライン学習/システムVLA群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- USER: 実世界オンライン方策学習のための統合拡張可能システム実世界オンライン学習/システム2026/2/1
実世界のロボット群をGPUと同様に扱うハードウェア抽象化と非同期学習基盤を提供し、オンライン模倣・強化学習やVLAモデルを長期実験で効率的に訓練できるシステムを構築した。
- 模倣を超えて:VLAモデルのための強化学習ベースのSim-Real協調学習VLA2026/2/1
実機とシミュレーションのデモでSFT後、シミュレーションで強化学習しつつ実機データの補助損失で忘却を防ぐ協調学習フレームワークを提案し、実機卓上操作タスクで成功率と汎化性能を向上させた。
- π_RL: フローベース視覚言語行動モデルのオンライン強化学習ファインチューニングVLA2025/10/29
フローマッチングに基づく大規模VLAモデルに強化学習を適用するため、Flow-NoiseとFlow-SDEの2手法を提案し、分布内外で性能を向上させた。
- RLinf-VLA:視覚言語行動モデルの強化学習のための統合効率フレームワークVLA2025/10/1
多様なVLAモデルとRLアルゴリズム、シミュレータを統合し、効率的な強化学習を可能にするフレームワークを提案。LIBEROやManiSkillなどで高い成功率を達成。
- 強化学習による静的・動的障害物回避を伴うマルチUAV編隊制御群制御2024/10/1
2段階の強化学習パイプラインと注意機構エンコーダ、カリキュラム学習を用いて、複数UAVの編隊維持と静的・動的障害物回避を両立させる手法を提案し、実機実験で有効性を示した。