Mingle Jiang
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚中断下での行動を視覚言語行動モデルで学習するVLA2026/9/28
カメラ映像が途切れてもロボットが作業を続けられるよう、視覚言語行動モデルを訓練し、推論時にオプティカルフローや世界モデルで欠損視覚を補完する手法MINTを提案し、ベンチマークMAIL-Benchで評価した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
カメラ映像が途切れてもロボットが作業を続けられるよう、視覚言語行動モデルを訓練し、推論時にオプティカルフローや世界モデルで欠損視覚を補完する手法MINTを提案し、ベンチマークMAIL-Benchで評価した。