Lei Lu
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Moxin-VLMとMoxin-VLAを備えたオープンソースマルチモーダルMoxinモデルVLA2025/12/22
完全オープンソースのLLM「Moxin」を基に、視覚言語理解・視覚言語行動・中国語対応の3つの派生モデルを開発し、公開した。
- VOTE: 軌道アンサンブル投票による視覚-言語-行動モデルの最適化VLA2025/7/1
VLAモデルの推論遅延と学習コストを削減するため、少ない行動トークンで並列生成する学習フレームワークと、過去と現在の予測を投票で統合する推論最適化を提案し、成功率と推論速度を大幅に向上させた。