Zhongyu Li
The Chinese University of Hong Kong
収録論文 56本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ヒューマノイドバドミントン:限られた人間動作データからの動的ラケットスキル学習マニピュレーション2026/9/25
三段階の階層型強化学習により、限られた人間のバドミントン動作データからヒューマノイドがフォアハンド・バックハンド・ジャンプ返球などの動的ラケットスキルを獲得し、実機で人間とのラリーを実現した。
- 連続体マニピュレータ向け支援強化型粒状ジャミンググリッパと強化学習による把持把持/ジャミンググリッパ2026/9/24
連続体マニピュレータ先端に装着する軽量な支援構造付き粒状ジャミンググリッパを設計し、膜材料や粒子・充填率・内部支持構造を最適化して把持境界を明らかにするとともに、強化学習による到達制御を実機に展開して把持・解放タスクを実現した。
- HiRE: 後知恵報酬編集による方策ファインチューニング強化学習2026/9/22
成功・失敗軌跡を後知恵で対比し、基盤表現モデルの報酬を制御中心に校正する訓練不要の枠組みを提案。
- 魚眼VLA:単一魚眼カメラで操作のための広域認識と高精細視野を両立VLA2026/9/22
単一の魚眼カメラから広域視野とエンドエフェクタ中心の局所クロップを同時に取得し、VLAモデルと組み合わせて卓上・棚・コンベア上の操作を実現した研究。
- 全身UMI:実時間動作生成によるヒューマノイド全身マニピュレーションへのUMIスキル転移全身マニピュレーション2026/9/19
UMIの手先軌道データからヒューマノイドの全身協調動作を実時間生成し、拡散方策と組み合わせて4タスクで全身マニピュレーションを実現した。
- 車輪脚ロコマニピュレーションのためのハイブリッド力覚センサレス推定を用いた力認識強化学習ロコマニピュレーション2026/9/12
エンドエフェクタの力覚センサを使わずに、運動量観測・接触制約レンチ投影・時間的残差学習を組み合わせて力を推定し、それを観測に組み込んだ全身強化学習で車輪脚ロボットの力制御を実現した。
- RynnWorld-4D: ロボット操作のための4D具現化ワールドモデルワールドモデル2026/7/1
RGB、深度、オプティカルフローを統合した4Dワールドモデルを提案し、将来のシーン変化を予測してロボット操作のポリシー学習を支援する。
- RoboDojo: 汎用ロボット操作ポリシーの包括的評価のための統合シミュレーション・実世界ベンチマークベンチマーク2026/7/1
シミュレーションと実世界の両方で汎用ロボット操作ポリシーを評価するための統一ベンチマークを提案し、42のシミュレーションタスクと18の実世界タスクで多様な能力を評価する。
- RynnWorld-Teleop: デジタル遠隔操作のための行動条件付きワールドモデルデータ生成2026/7/1
物理的な遠隔操作に代わり、生成ワールドモデルを用いてロボット中心の映像を合成し、実機不要で模倣学習用の軌道データを生成するデジタル遠隔操作パラダイムを提案した。
- Action QFormer: 行動監視下での構造化表現形成による視覚言語行動モデルの性能向上VLA2026/7/1
視覚言語行動モデルにおいて、行動監視が継承したマルチモーダル表現を形成する役割を分析し、クエリベースのインターフェースを導入して行動に適した表現を再構成することで、ゼロショットsim-to-realナビゲーションの成功率を大幅に向上させた。
- KEMO: 長期的ロボット操作のためのイベント駆動キーフレームメモリとVLAポリシーマニピュレーション2026/6/1
長期的なロボット操作において、過去の重要な状態変化をキーフレームとして自動選択・記憶し、VLAポリシーに統合する軽量なプラグインメモリフレームワークKEMOを提案。実機の双腕操作タスクで成功率を大幅に向上させた。
- RoboNaldo: 動作誘導カリキュラム強化学習による正確で安定かつ強力なヒューマノイドサッカーシュートロコモーション/強化学習2026/6/1
人間のキック動作を参照として段階的に最適化する3段階カリキュラム強化学習フレームワークを提案し、ヒューマノイドロボットによる高インパルスで正確なサッカーシュートを実現した。
- VRA: 電圧制約アクチュエーションにおける離散時間関節加速度の接地制御/アクチュエーション2026/5/1
電圧制約下の電気アクチュエータで物理的に実現不可能な関節加速度を排除する、電圧実現可能加速度(VRA)インターフェースを提案し、ハードウェア実験で有効性を実証した。
- オンデバイス計算制約下での強化学習によるマイクロロボット制御マイクロロボット/強化学習2025/12/1
サブセンチメートル四足歩行マイクロロボットの強化学習制御を超小型SoC上に実装し、量子化と歩容スケジューリングで電力制約下の推論周波数を最適化した。
- GenDexHand:多指ハンドのための生成的シミュレーションマニピュレーション2025/11/1
VLMのフィードバックで物体配置を調整する閉ループ生成により、多指ハンド操作用の多様なタスクと環境を自動生成し、サブタスク分解で強化学習の効率と成功率を高める手法を提案。
- ガウススプラッティングによる実世界ゼロショットロボットマニピュレーション学習のための高忠実度シミュレーションデータ生成sim2real2025/10/1
実世界の多視点画像から3DGSとメッシュを組み合わせて物理的に操作可能な高忠実度シミュレーション環境を構築し、MLLMで物体の物理特性や関節構造を自動推定することで、シミュレーションのみで訓練した方策が実世界の多様なマニピュレーションタスクへゼロショット転移できることを示した。
- ヒューマノイドの接触計画のための自己視点ワールドモデル接触計画2025/10/1
自己視点の深度画像と固有感覚から、学習したワールドモデルとMPCを組み合わせてヒューマノイドの接触を伴う動作計画を実現した研究。
- 四足歩行ロボットチームによる実世界での協調・競争サッカーに向けてマルチエージェント強化学習2025/5/1
階層型マルチエージェント強化学習により、四足歩行ロボットが自律的に協調・競争サッカーを行うフレームワークを提案し、実機でロボット同士や人間との試合を実現した。
- Berkeley Humanoid Lite:オープンソースで入手しやすくカスタマイズ可能な3Dプリントヒューマノイドロボットの実演ヒューマノイド/オープンソースハードウェア2025/4/1
市販部品とデスクトップ3Dプリンタで作れる低コスト(5000ドル以下)のオープンソースヒューマノイドロボットを開発し、強化学習による歩行制御でその能力を実証した。
- LangWBC: 言語指示によるヒューマノイド全身制御のエンドツーエンド学習VLA2025/4/1
言語コマンドを直接解釈してヒューマノイドの全身動作を生成するエンドツーエンド方策を、強化学習と方策蒸留およびCVAE構造で実現し、実機で検証した。
- 四足歩行ロボットチームによるケーブル牽引荷物の分散ナビゲーション:MARLアプローチ群制御2025/3/1
複数の四足歩行ロボットがケーブルで繋がれた荷物を協調して牽引し、障害物を避けながら狭い環境をナビゲートするための分散型マルチエージェント強化学習プランナーを開発した。実機で1~4台、シミュレーションで最大12台のロボットでの有効性を実証した。
- 不整地における四足ロボットのオンライン全方向跳躍軌道計画跳躍/軌道計画2024/11/1
不整地で四足ロボットが全方向に跳躍するための、軌道生成・追従制御・着地制御を統合したオンライン最適化フレームワークを提案し、運動学的制約を考慮した高速進化アルゴリズムと着地後の高精度位置推定を実現した。
- 適応的な非把持移動マニピュレーションによる対話型ナビゲーション移動マニピュレーション2024/10/1
未知の動特性を持つ屋内物体を押す操作のために、学習したSE(2)動特性表現をMPPI制御に統合し、物体を動かしながらナビゲーションする枠組みを提案した。
- 実世界の視覚データから学習する走破性認識型脚式ナビゲーション歩行2024/10/1
脚式ロボットの制御器の価値関数に基づいて走破性コストをロボット中心に推定し、RGBDナビゲーション計画に統合して実世界で効率的に強化学習する手法を提案した。
- Lipschitz制約付きポリシーによる滑らかなヒューマノイド歩行の学習歩行2024/10/1
方策にLipschitz制約を勾配ペナルティとして課すことで、低域通過フィルタや平滑化報酬を使わずに滑らかで頑健なヒューマノイド歩行制御を学習する手法を提案し、実機で検証した。
- 制約付き再重み付け深層行列分解による複数回転平均化回転平均化2024/9/1
ラベル不要の深層行列分解で複数回転平均化を解き、スパニングツリーによる外れ値除去と再重み付けでロバスト性を高めた手法を提案。
- CurricuLLM:大規模言語モデルを用いた複雑なロボットスキル学習のための自動タスクカリキュラム設計強化学習/カリキュラム学習/LLM2024/9/1
大規模言語モデルを活用して、ロボットの複雑なタスクを段階的なサブタスクに分解し、報酬コードや目標分布コードを自動生成することで、カリキュラム学習を効率的に設計する手法を提案した。
- HiLMa-Res: 残差強化学習による四脚ロボットの移動と操作を統合する汎用階層フレームワーク移動操作2024/7/1
四脚ロボットが歩行しながら脚で操作を行うための階層型強化学習フレームワークを提案し、実機で複数の移動操作タスクにおいて既存手法より優れた性能を示した。
- Berkeley Humanoid:学習ベース制御のための研究プラットフォーム歩行2024/7/1
低コストで信頼性の高い中型ヒューマノイドロボットを開発し、軽度のドメインランダム化を用いた強化学習制御により、屋外の様々な地形での俊敏な歩行や跳躍を実現した。
- 大規模言語モデルを用いた四足歩行ロボットの長期的な移動と操作VLA2024/4/1
大規模言語モデルを活用し、四足歩行ロボットが長期的なタスクを計画・実行するシステムを構築した。強化学習による運動・操作スキルと組み合わせ、道具の作成や人間への助け要請などの複雑な行動を実現した。
- DiffuseLoco: オフラインデータセットからの拡散モデルによるリアルタイム脚式移動制御歩行2024/4/1
オフラインデータセットから拡散モデルを用いて多様な脚式移動スキルを学習し、実機の四足ロボットでリアルタイム制御とゼロショット転移を実現したフレームワーク。
- 脚式ロコモーション制御における対称性を活用した強化学習歩行2024/3/1
脚式ロボットの強化学習において、ネットワークの同変・不変性やデータ拡張で対称性を組み込み、サンプル効率と歩容品質を改善し実機へゼロショット転移できることを示した。
- 四足歩行ロボットの脚による実世界操作をデモンストレーションから学習マニピュレーション2024/3/1
四足歩行ロボットが脚のみを使って物体を操作できるよう、強化学習ベースの低レベル制御と模倣学習ベースの高レベル計画を組み合わせた手法を提案し、実機で籠の持ち上げやボタン押しなどを実現した。
- Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control2024/1/1
- i2LQR: Iterative LQR for Iterative Tasks in Dynamic Environments2023/2/1
- Robust and Versatile Bipedal Jumping Control through Reinforcement Learning2023/2/1
- Walking in Narrow Spaces: Safety-critical Locomotion Control for Quadrupedal Robots with Duality-based Optimization2022/12/1
- Creating a Dynamic Quadrupedal Robotic Goalkeeper with Reinforcement Learning2022/10/1
- GenLoco: Generalized Locomotion Controllers for Quadrupedal Robots2022/9/1
- Hierarchical Reinforcement Learning for Precise Soccer Shooting Skills using a Quadrupedal Robot2022/8/1
- Collaborative Navigation and Manipulation of a Cable-towed Load by Multiple Quadrupedal Robots2022/6/1
- Adapting Rapid Motor Adaptation for Bipedal Robots2022/5/1
- Bridging Model-based Safety and Model-free Reinforcement Learning through System Identification of Low Dimensional Linear Models2022/5/1
- Teaching Robots to Span the Space of Functional Expressive Motion2022/3/1
- Bayesian Optimization Meets Hybrid Zero Dynamics: Safe Parameter Learning for Bipedal Locomotion Control2022/3/1
- Automated Catheter Tip Repositioning for Intra-cardiac Echocardiography2022/1/1
- Autonomous Navigation of Underactuated Bipedal Robots in Height-Constrained Environments2021/9/1
- Autonomous Navigation for Quadrupedal Robots with Optimized Jumping through Constrained Obstacles2021/7/1
- Enhancing Feasibility and Safety of Nonlinear Model Predictive Control with Discrete-Time Control Barrier Functions2021/5/1
- 3DMNDT:3D multi-view registration method based on the normal distributions transform2021/3/1
- Reinforcement Learning for Robust Parameterized Locomotion Control of Bipedal Robots2021/3/1
- Robotic Guide Dog: Leading a Human with Leash-Guided Hybrid Physical Interaction2021/3/1
- Animated Cassie: A Dynamic Relatable Robotic Character2020/9/1
- Towards Automatic Manipulation of Intra-cardiac Echocardiography Catheter2020/9/1
- Multi-view registration of unordered range scans by fast correspondence propagation of multi-scale descriptors2018/4/1
- Simultaneous merging multiple grid maps using the robust motion averaging2017/6/1