Zhuo Li
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WholeBodyWAM:世界行動事前分布を全身制御に接地させたヒューマノイド移動操作VLA2026/9/15
視覚予測と行動を同時に学習する世界行動モデルを、全身制御器の意味づけと協調に接地させることで、ヒューマノイドの移動を伴う操作へ汎化させる手法を提案した。
- 推論コストなしの推論:ロボットVLAポリシーのための潜在意味的足場VLA2026/9/4
ロボットのVLAモデルに、推論時のコストを増やさずに物理的推論の能力を持たせるため、訓練中にアクショントークンの表現をテキストの推論根拠に合わせる補助損失を導入し、推論時にはそのヘッドを捨てる手法を提案した。
- ロボット操作のための未来潜在状態からの行動推論操作2026/8/22
ビデオ生成を介さず、未来の潜在状態からロボットの行動を直接推論する新しい世界行動モデルを提案し、計算コストを削減しつつ長期的な操作タスクで有効性を示した。
- 点付随意味論を超えて:汎用操作のためのオブジェクト中心意味場マニピュレーション2026/7/1
物体点群から機能部品の意味埋め込みを連続的に読み出すオブジェクト中心の意味場を提案し、操作ポリシーの条件付けに利用して性能を向上させた。
- 言う通りに適応せよ:人間の言語フィードバックによるオンライン対話的双腕スキル適応双腕操作/言語フィードバック/適応2026/3/1
オフライン学習した双腕スキルを、人間の言語フィードバックを用いてゼロショットでオンライン適応させるフレームワークBiSAILを提案。階層的な推論と拡散変調により、タスク変化に応じた動作調整を実現し、実機実験で有効性を示した。
- 微調整なしでVLAを実運用:身体性進化拡散によるプラグアンドプレイ推論時ポリシー誘導VLA2025/11/1
事前学習済みVLAモデルを追加の微調整やデータ収集なしで実機展開するため、推論時にポリシーを誘導するプラグアンドプレイ手法VLA-Pilotを提案し、実世界の操作タスクで成功率を大幅に向上させた。
- ManiDP: 姿勢依存型両腕マニピュレーションのための可操作度を考慮した拡散ポリシーマニピュレーション2025/10/1
専門家のデモから両腕の可操作度を抽出し、リーマン幾何に基づく確率モデルで姿勢特徴を符号化して条件付き拡散過程に組み込むことで、姿勢依存の力・速度要件を満たす両腕動作を生成する模倣学習手法を提案。
- CORB-Planner: 高速飛行におけるRLプランニングのための観測としてのコリドー飛行制御/強化学習2025/9/1
安全飛行コリドーを低次元観測として用い、Bスプライン軌道生成と強化学習を組み合わせることで、様々なドローン機体で高速自律飛行を実現するリアルタイム軌道計画フレームワークを提案した。
- CMD: ステレオマッチングのドメイン適応におけるマルチモーダル分布の制約ステレオマッチング/ドメイン適応2025/4/1
教師なしドメイン適応で問題となるマルチモーダルな視差分布を、不確実性正則化と異方性ソフトargminで単峰化し、合成から実世界への汎化性能を向上させた。
- 分解型敵対的模倣学習による人間からヒューマノイドへの身体横断的行動スキル転移模倣学習/身体横断転移2024/12/1
人間のデモから行動プリミティブを学習し、身体構造を機能部品に分解して調整することで、多様なヒューマノイド間でスキルを転移するフレームワークを提案した。
- Soft Decomposed Policy-Critic: Bridging the Gap for Effective Continuous Control with Discrete RL2023/8/20
- Time-attenuating Twin Delayed DDPG Reinforcement Learning for Trajectory Tracking Control of Quadrotors2023/2/1