Zhongru Zhang
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 動画予測ポリシー2:より良く予測し、より良く行動するVLA2026/10/7
操作動画で基盤動画モデルを追加事前学習し、単段階の視覚プランナに蒸留、MoTで行動モジュールを統合することで、オープンエンドな操作タスクにおけるゼロショット汎化性能を大幅に向上させた世界行動モデル。
- Veo-Act: 最先端ビデオモデルはどこまで汎用ロボット操作を前進させられるか?操作2026/4/1
ビデオ生成モデルVeo-3を高次プランナーとして使い、低次実行にはVLAポリシーを用いる階層的フレームワークVeo-Actを提案し、操作性能を向上させた。