Ming Hu
収録論文 2本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 幾何認識モーション潜在表現によるロバストな操作ポリシーの学習マニピュレーション2026/7/1
操作中の点群の時間変化を予測することで、外観ではなく物理的な動きを符号化する離散モーション潜在コードを学習し、単視点RGB-D入力で最先端の操作性能を達成した論文。
- LLaVA-OneVision-2:次世代知覚知能に向けてVLA2026/5/25
動画を圧縮ビットストリームとして扱い、適応的な時間グループと空間的証拠の選択によりトークン予算を効率的に配分する新しい視覚言語モデルを提案。大規模なオープン監視データで学習し、動画理解や時間的・空間的接地、操作トレース推論などで高性能を達成。