Yuze Zhu
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BridgeVLA++: 3次元操作のためのデータ効率的で汎化可能なメモリ拡張型視覚言語行動フレームワークVLA2026/8/1
事前学習済み視覚言語モデルを活用した3次元ロボット操作フレームワークBridgeVLAを拡張し、空間的・時間的メモリを統合することで、データ効率と汎化性能を保ちつつ、記憶依存の操作タスクで最先端の性能を達成した。
- SC$^{2}$-WM: 連続環境における視覚・言語ナビゲーションのための閉ループフィードバックを備えた自己修正ワールドモデルVLA2026/8/1
VLN-CEタスクにおいて、内部フィードバックを用いた閉ループ意思決定を行う自己修正ワールドモデルを提案し、状態ドリフトを検出・修正してナビゲーションの堅牢性を向上させた。