Zhuoyang Zhang
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- π0.7: 操縦可能な汎用ロボット基盤モデルと創発的能力VLA2026/4/1
多様なコンテキスト条件付けを用いて、未見環境での言語指示追従やゼロショットの身体汎化を実現するロボット基盤モデルπ0.7を提案した。
- ForeAct: 効率的な視覚的先読み計画でVLAを誘導するVLA2026/2/1
将来の観測画像とサブタスク記述を生成してVLAの視覚入力に追加するだけで、アーキテクチャ変更なしに実世界タスクの成功率を大幅に向上させる計画モジュールを提案。
- VLASH: 未来状態を考慮した非同期推論によるリアルタイムVLAVLA2025/12/1
ロボットの状態を前回の行動チャンクで先読みし、予測と実行の時間ずれを解消することで、追加コストなしにVLAの非同期推論を高速化・安定化する手法を提案。
- CoT-VLA:視覚的思考連鎖推論を用いた視覚-言語-行動モデルVLA2025/3/1
将来の画像フレームを視覚的目標として自己回帰的に予測してから行動系列を生成することで、視覚的思考連鎖推論をVLAに組み込み、実世界タスクで17%の性能向上を達成した。