Zhuoyang Song
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AtomEgo: 一人称視点ロボット統合による身体性基盤モデル事前学習の探求VLA2026/9/18
約2,659時間の一人称視点人間データとロボットデータを組み合わせ、身体性基盤モデルの事前学習における効果的な統合手法を体系的に検討した研究。
- PVI: 視覚言語行動モデルのためのプラグイン型視覚注入VLA2026/3/1
事前学習済みの視覚言語モデルと行動エキスパートを組み合わせたVLAアーキテクチャに対し、軽量でエンコーダ非依存のモジュールを追加し、時間的視覚特徴を注入することで性能を向上させる手法を提案した。