Wengang Zhou
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション模倣学習歩行ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WAM-OPD: オンポリシー蒸留によるワールドアクションモデルの高性能化VLA2026/9/28
事前学習済みワールドアクションモデルを、環境ロールアウトを繰り返さずにオンポリシー蒸留で専門タスクに適応させる手法WAM-OPDを提案。
- EventVLA: イベント駆動型視覚証拠メモリによる長期的視覚言語行動ポリシーVLA2026/6/18
長期的なロボット操作タスクで、視覚情報が隠れたり見えなくなったりする問題に対処するため、重要な視覚イベントを予測して記憶する新しいフレームワークEventVLAを提案した。シミュレーションと実機タスクで既存手法より成功率が大幅に向上した。
- 構造的アクショントランスフォーマーによる3次元器用操作マニピュレーション2026/3/1
高自由度ロボットハンドの異種エンボディメント間スキル転移を可能にするため、アクションを時間列ではなく関節軌道の可変長・非順序集合として捉える構造的表現を導入し、3D点群から連続時間フローマッチングで軌道生成するSATを提案した。
- ロボット模倣における行動生成のための粗密分離フレームワーク模倣学習2026/2/1
行動を粗い離散モードと細かい連続行動に分離する2段階手法を提案し、多峰性行動の模倣学習を安定化させ、ベンチマークと実機で性能を向上させた。
- 実時間足元地形再構成を伴う歩容適応型知覚ヒューマノイド歩行歩行2025/12/1
足元を向いた深度カメラとU-Netでリアルタイムに自己中心的高さマップを再構成し、知覚と歩容位相・全身制御を単一の強化学習ポリシーに統合することで、階段やギャップを含む複雑地形でのヒューマノイド歩行を実現した。
- P-RAG: 具現化された日常タスクの計画のための漸進的検索拡張生成VLA2024/9/1
大規模言語モデルを用いた日常タスク計画において、正解データなしでタスク固有の知識を反復的に蓄積する漸進的検索拡張生成手法を提案し、類似タスクと類似状況のきめ細かい検索で性能を向上させた。
- インスタンス認識型探索・検証・活用によるインスタンス画像ゴールナビゲーションナビゲーション2024/2/1
目標画像に写る特定物体へ未探索環境でたどり着くため、遠くからでも「近づいて確認する」人間の行動を模し、探索・検証・活用を切り替えるナビゲーション手法を提案した。