Yinfei Yang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SO-Bench:マルチモーダルLLMの構造化出力評価ベンチマークVLA2025/11/1
UI画面・自然画像・文書・グラフの4領域で、画像からJSONスキーマに沿った構造化出力を生成する能力を評価するベンチマークSO-Benchを構築し、既存モデルの課題を明らかにした。
- マルチモーダル大規模言語モデルによる一人称視点動画質問応答の高度化VLA2025/4/1
一人称視点動画のQAデータセットQaEgo4Dv2を整備し、4つのMLLMをゼロショットとファインチューニングで評価、オープンソースモデルが新たな最高性能を達成した。
- A New Path: Scaling Vision-and-Language Navigation with Synthetic Instructions and Imitation Learning2022/10/1