Mingsheng Li
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA強化学習クロスエンボディメント学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FineVLA: 操縦可能な視覚言語行動ポリシーのための細粒度命令整合VLA2026/5/1
ロボットタスクの実行方法に関する細かい指示(腕、方向、接触領域など)をVLAモデルに学習させるためのデータセットとベンチマーク、およびポリシーを構築した。
- Qwen-VLA:タスク・環境・ロボット形態を横断する視覚言語行動モデルの統合VLA2026/5/1
多様なロボットタスクを単一の視覚言語行動モデルに統合するQwen-VLAを提案し、操作・ナビゲーション・軌道予測を統一フレームワークで扱う。
- GaussFly: 3Dガウス場における視覚運動ポリシーのための対比強化学習強化学習2026/4/1
単眼視覚のみを用いた自律航空機の視覚運動ポリシー学習において、3Dガウススプラッティングによる高忠実なシミュレーション環境を構築し、対比表現学習でノイズに頑健な特徴を抽出することで、サンプル効率とsim-to-real転送を向上させるフレームワークを提案した。
- カメラ座標系でロボット動作を統一するクロスエンボディメント学習2025/11/1
カメラ外部パラメータを用いて異なるロボットの動作をカメラ座標系で統一し、訓練不要でカメラ外部パラメータを推定するCalibAllを提案。16データセットで約97Kエピソードを校正し、クロスエンボディメント事前学習で最先端性能を達成。