Meng Li
Beijing Innovation Center of Humanoid Robotics
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WholeBodyWAM:スケーラブルな動作事前分布を用いた全身ワールドアクションモデルの学習全身マニピュレーション2026/9/16
人間やヒューマノイドの大規模動作データを事前学習に活用し、全身動作を予測するMotion Expertを組み込んだワールドアクションモデルを提案。実機ヒューマノイドの全身マニピュレーション性能を向上させた。
- MeRoPE: カメラ制御ビデオ生成のためのメトリック回転位置埋め込みビデオ生成2026/9/1
カメラ制御ビデオ生成において、実世界のメトリックカメラ軌道でスケール依存の失敗を起こさない、ノルム保存型の相対カメラエンコーディングMeRoPEを提案した。
- HAF: 階層的アクションフローとスペクトル潜在RLによる汎用VLAのヒューマノイド全身移動操作への適応ヒューマノイド/VLA/強化学習2026/8/17
汎用VLA基盤モデルをヒューマノイドの全身移動操作に適応させるための2部構成フレームワークHAFを提案。階層的なアクション生成とオンラインRLによるポリシー改善を実現する。
- Jetson-PI: 先読み整合非同期推論による搭載リアルタイムロボット制御の実現VLA/エッジ推論2026/7/1
低消費電力の搭載デバイス上でVLAモデルを高速に動作させるため、非同期推論の課題を解決する先読み整合補正と信頼度ベースのスケジューリングを提案した論文。
- 意味的スキル発見による四足ロボットの継続的協調群制御2026/6/1
複数の四足ロボットが連続的に現れる協調タスクを学習する際、過去のスキルを忘れずに再利用できる意味的スキルライブラリフレームワーク「Conquer」を提案した。
- UniLab: GPU中心パラダイムを超えたロボット強化学習のためのヘテロジニアスアーキテクチャ強化学習/システムアーキテクチャ2026/5/1
CPUシミュレーションとGPU学習を分離したヘテロジニアスな強化学習システムUniLabを提案し、GPUシミュレーションに依存せずに3〜10倍の学習効率向上を実証した。
- HEX: 人間型アライメント専門家によるクロスエンボディ全身操作全身操作/VLA2026/4/1
全身協調操作を実現するため、人間型ロボットに特化した状態中心フレームワークHEXを提案。多様な身体構造に適用可能な状態表現と、全身協調と時間的運動ダイナミクスをモデル化する専門家混合機構を導入し、実機での操作成功率と汎化性能を向上させた。
- KEEP: 具現化プランニングのためのKVキャッシュ中心メモリ管理システムVLA2026/2/1
LLMによる長期的な具現化プランニングで、メモリをKVキャッシュとして効率的に管理し、再計算を抑えつつ高速化と精度維持を両立するシステムKEEPを提案。
- RoboAug: 領域対比データ拡張による単一アノテーションから数百シーンへのロボットマニピュレーションマニピュレーション2026/2/1
1枚の画像のバウンディングボックス注釈だけで生成モデルと領域対比損失を用いてデータ拡張を行い、ロボットマニピュレーションの汎化性能を向上させる手法を提案。
- DySL-VLA: 動的・静的層スキップによるロボットマニピュレーション向けVLAモデルの効率的推論VLA2026/2/1
タスク内の行動の重要度に応じてVLAモデルの層を動的にスキップし、精度を保ちつつ計算コストを大幅に削減するフレームワークを提案。
- RoboGene: 多様性駆動型エージェントフレームワークによる実世界タスク生成でVLA事前学習を強化VLA2026/2/1
多様で物理的に実現可能な操作タスクを自動生成するエージェントフレームワークを提案し、VLAモデルの事前学習データ収集を効率化して汎化性能を向上させた。
- RoboMIND 2.0:汎用身体知能のためのマルチモーダル両腕移動マニピュレーションデータセットマニピュレーション2025/12/1
6種類のロボットで集めた31万件超の両腕操作・移動マニピュレーション軌道(触覚・シミュレーション含む)を公開し、階層型VLM+VLAシステムMIND-2を提案した論文。
- XR-1: 統合視覚運動表現の学習による汎用視覚-言語-行動モデルVLA2025/11/1
視覚ダイナミクスとロボット運動を統合した離散潜在表現UVMCを二枝VQ-VAEで学習し、異種ロボットデータを横断する汎用VLAモデルXR-1を三段階学習で構築した研究。
- EfficientNav: ナビゲーションマップのキャッシュと検索によるオンデバイス物体目標ナビゲーション物体目標ナビゲーション2025/10/1
小型LLMをオンデバイスで動かすため、ナビゲーションマップの意味論的検索とKVキャッシュの再利用を組み合わせ、物体目標ナビゲーションを高速化・高精度化した研究。
- FreqPolicy: 周波数一貫性による効率的なフローベース視覚運動ポリシーVLA2025/6/1
フローベースの視覚運動ポリシーに周波数領域の一貫性制約を導入し、時間的連続性を保ちながら1ステップでの高品質な行動生成を可能にした手法。
- SwitchVLA: 実行状態を考慮したタスク切り替えが可能な視覚-言語-行動モデルVLA2025/6/1
実行中に指示が変わっても柔軟に対応できるVLAフレームワークを提案し、外部プランナーや専用データなしで滑らかなタスク切り替えを実現した。
- CDKFormer: 長尾軌道予測のための文脈的逸脱知識ベースTransformer軌道予測2025/3/1
長尾軌道予測の課題に対し、個別運動と群集相互作用から逸脱特徴を抽出し、注意機構と二重クエリデコーダでマルチモーダル予測を行うTransformerモデルを提案した。
- RoboMIND:ロボットマニピュレーションのためのマルチエンボディメント知能規範データセットマニピュレーション2024/12/1
4種類のロボットによる10.7万件の模倣学習用デモンストレーション軌道と失敗例、デジタルツイン環境を提供する大規模データセットを構築し、VLAモデルの性能を評価した。
- 心臓コパイロット:ワールドモデルによる心エコー検査の自動プローブガイダンス医療ロボティクス2024/6/1
心エコー検査において、経験の浅い検査技師を支援するため、データ駆動型ワールドモデル「Cardiac Dreamer」を用いてリアルタイムのプローブ移動ガイダンスを提供するシステムを提案した。
- VascularPilot3D:血管内ロボティクスのための3D完全自律ナビゲーションに向けて血管内ロボティクス/自律ナビゲーション2024/5/1
術中透視X線画像と血管内ロボットを用い、3D-2D血管位置合わせやガイドワイヤセグメンテーション、トポロジー制約付き端点推定、木構造ベースの経路計画を組み合わせた完全自律3Dナビゲーションシステムを開発し、体外実験25回で成功率100%を達成した。
- Iterative PnP and its application in 3D-2D vascular image registration for robot navigation2023/10/1
- Optical flow-based vascular respiratory motion compensation2023/8/1
- ${S}^{2}$Net: Accurate Panorama Depth Estimation on Spherical Surface2023/1/1
- Towards High-Performance Solid-State-LiDAR-Inertial Odometry and Mapping2020/10/1