Xin Nie
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- iFLYTEK-Embodied-Omni技術報告VLA2026/6/24
視覚・言語・行動を単一のOmniフレームワークで統合したマルチモーダル基盤モデルを提案し、脳と小脳の協調に例えられる設計で、指示理解から行動生成までを一貫して行う。
- GEAR-VLA: 汎用ロボット操作のための幾何認識行動表現の学習VLA/操作2026/6/7
VLAモデルの実世界での汎化を改善するため、幾何認識型の行動表現を学習するGEAR-VLAを提案。粗密行動学習、3D特徴の整合、エンボディメント正準化により、未見物体や異なるロボットへの汎化を実現した。
- iFlyBot-VLM 技術報告VLA2025/11/1
視覚と言語を統合し、ロボットの知覚と動作制御をつなぐ汎用VLMを提案。10のベンチマークで最高性能を達成し、データと重みを公開予定。