Sanjay Haresh
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- セルフノート:メモリ依存操作タスクのためのスクラッチパッド拡張VLAVLA2026/2/1
言語スクラッチパッドをVLAに導入し、空間・時間メモリを付与することで、メモリ依存の長期的操作タスクの汎化性能を向上させた研究。
- 重要なものに注目:視覚言語行動モデルのための物体・エージェント中心トークン化VLA2025/9/1
物体とエージェントに注目したトークン化で視覚トークン数を大幅に削減し、VLAモデルの学習を高速化・高性能化する手法を提案。
- ClevrSkills: ロボティクスにおける構成的言語・視覚推論VLA2024/11/1
ロボット操作タスクの構成的推論を評価するベンチマークClevrSkillsを提案し、視覚言語モデルが低レベル技能を組み合わせた高レベルタスクに失敗することを示した。