Jaewoo Song
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- マルチモーダル行動モデル評価・適応のためのオープンソースツールキットとベンチマークスイートVLA2025/6/10
視覚・言語・行動を統合したマルチモーダル行動モデルを評価・適応するためのオープンソースベンチマーク「MultiNet」と関連ツールキットを提案し、1.3兆トークン超の複合データセットを提供する。
- ロボット学習タスクにおける視覚・言語・行動モデルのベンチマーク評価VLA2024/11/1
GPT-4oやOpenVLAなど3つのVLAモデルを20種類の操作タスクで評価し、性能のばらつきや多段階計画の難しさを明らかにした。