Jianlou Si
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ViDAL: 視覚ダイナミクスに基づく視覚言語行動モデル用の行動潜在空間VLA2026/10/6
行動が引き起こす未来の視覚変化に整合する連続行動潜在空間を学習し、複数のVLAモデルに組み込める行動インターフェースとして成功率を大幅に向上させた論文。
- FlowWAM: オプティカルフローを世界行動モデルの統一アクション表現として用いるVLA2026/7/1
事前学習済みビデオ生成モデルを活用する世界行動モデル(WAM)において、アクション表現としてオプティカルフローを用いることで、制御精度と世界モデリング性能を向上させる手法を提案した。