Lianlei Shan
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 考えるより先に動け:視覚言語行動モデルにおける強化学習を用いた潜在推論と早期終了戦略VLA2026/6/13
視覚言語行動モデルにおいて、明示的なテキスト推論を避け、潜在変数による推論を強化学習で最適化し、信頼度に応じて推論を早期終了することで、高速かつ高精度な行動決定を実現した。
- 多様な潜在世界モデルによる効率的なマルチモーダル推論VLA2026/6/13
視覚入力の複数の解釈を潜在空間で並列に推論し、強化学習で計算資源を適応配分するマルチモーダル推論フレームワークDLWMを提案した。
- PearlVLA: 潜在空間における段階的動作計画の洗練VLA2026/6/1
視覚言語行動モデル(VLA)の推論を潜在空間で行うことで、高速な動作生成と明示的な熟考の両立を実現するフレームワークを提案した。
- MPCoT: 報酬誘導型マルチパス潜在推論によるテスト時スケーラブルな視覚言語行動モデルVLA2026/6/1
視覚言語行動(VLA)モデルの推論時に、複数の潜在的な行動仮説を並列に洗練して統合する報酬誘導型フレームワークを提案し、長期的タスクの成功率を向上させた。