Lingyu Kong
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OccVLA: 暗黙的3D占有監督を備えた視覚-言語-行動モデルVLA2025/9/1
2D画像から3D占有を予測・監督信号として学習し、推論時には計算負荷を増やさずに自動運転の軌道計画と3D視覚質問応答で最高性能を達成したVLAモデル。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
2D画像から3D占有を予測・監督信号として学習し、推論時には計算負荷を増やさずに自動運転の軌道計画と3D視覚質問応答で最高性能を達成したVLAモデル。