Yongming Rao
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLMの知能をロボット制御へ転移するVLA2026/9/19
VLMに離散的な移動・回転・グリッパ指令のインターフェースを与え、閉ループでロボットを制御させる手法RoboDawnを提案。タスク特化の学習なしで既存手法を上回り、実演1回の文脈内学習でSOTAを達成した。
- Hy-Embodied-VLM-1.0:効率的な物理世界エージェントVLA2026/7/14
物理世界で動作する組み込みエージェント向けの基盤モデルを提案し、行動中心の能力分類に基づくデータパイプラインと効率的なMoEアーキテクチャにより、38ベンチマークで優れた性能を達成した。
- Hy-Embodied-0.5-VLA:視覚言語行動モデルから実世界ロボット学習スタックへVLA2026/6/1
データ収集からモデル設計、事前学習、微調整、強化学習、実機展開までを含むロボット学習の全スタックを備えたエンドツーエンドシステムを提案した論文。
- GEM: 生成的監視が身体化知能を強化するVLA2026/5/27
視覚言語モデルの事前学習に深度マップ生成タスクを統合し、身体化環境での空間・物理理解を向上させるGEMを提案。大規模データセットGEM-4Mを公開し、シミュレーションと実世界で高い性能を実証した。
- HY-Embodied-0.5: 実世界エージェントのための具現化基盤モデルVLA2026/4/8
実世界の具現化エージェント向けに設計された基盤モデル群を提案し、空間・時間的視覚知覚と推論能力を強化した。
- LiDAR Distillation: Bridging the Beam-Induced Domain Gap for 3D Object Detection2022/3/1
- P$^2$GNet: Pose-Guided Point Cloud Generating Networks for 6-DoF Object Pose Estimation2019/12/1