Zhaowen Li
Yinwang Intelligent Technology Co., Ltd.
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ワールドモデルからワールドアクションモデルへ:次状態予測の再考VLA2026/9/28
次状態の表現をRGBや単一特徴に固定せず、視覚・意味・幾何・相互作用の複数投影を動的にサンプリングして統合学習するCF-WAMを提案し、人間とロボットの経験を共有遷移学習に活かして制御性能と汎化を向上させた。
- ReSync: 非同期ワールドアクションモデルにおける二つのクロックの再同期VLA2026/9/27
未来の映像と行動を別々のスケジュールで生成する非同期推論において、行動と映像の進捗のずれを「コミットメント・エビデンスギャップ」として定式化し、その間隔内で計算を再配置するReSyncを提案。パラメータ変更なしで成功率を4.48ポイント改善。
- HarnessWAM:世界行動モデルにおける予測と熟考の橋渡しVLA2026/8/1
世界行動モデル(WAM)の予測と実行のギャップを埋めるエージェントフレームワークを提案。視覚言語モデルによるタスク管理とイベント駆動の二重タイムスケールフィードバックで、複雑なタスクの計画・実行・失敗回復を実現する。
- DiM-WAM: 多様な履歴イベントメモリを用いた世界行動モデリングVLA2026/6/1
長期依存タスク向けに、多スケールの履歴コンテキストとタスク進捗を統合したメモリ拡張型世界行動モデルを提案し、ロボット操作の成功率を大幅に向上させた。
- UniBYD: 人間の模倣を超えた多様なロボットハンドの操作学習のための統合フレームワークマニピュレーション2025/12/1
ロボットと人間の身体差を超え、多様なロボットハンド形態に適応する操作方策を強化学習で獲得する統合フレームワークUniBYDを提案。動的PPOと影エンジンにより人間模倣を超えた適応的探索を実現。