Shunyu Liu
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 意味・動態・制御を再配線する:シンプルかつ効果的な行動中心型トリプルストリームTransformerVLA2026/10/8
VLMと動画生成ワールドモデルを別々のストリームとして保持しつつ、行動専門家が層ごとのアテンションで両者の表現を統合するACT³を提案し、実機・シミュレーションのマニピュレーションで優れた性能を示した。
- SpatialCLI: 空間ツールで推論し、その後ツールなしで推論する学習VLA2026/7/30
視覚言語モデルに空間ツールを使った推論を教え、徐々にその能力を内部化させる3段階フレームワークを提案。ベンチマークで大幅な性能向上を実証した。