Yimeng Dong
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ジェスチャー対応視覚言語行動モデルGesVLA:埋め込み表現による操作精度の向上VLA2026/5/1
テキスト指示だけでは曖昧な空間指示を解決するため、ジェスチャーを並列指示として取り入れ、潜在空間に直接エンコードする視覚言語行動モデルGesVLAを提案した。実世界のロボット操作タスクで、複雑な環境での目標把握精度と対話効率が向上することを示した。