Keze Wang
収録論文 9本 ・ フィジカルAI/ロボット学習
VLA世界モデルマニピュレーション行動生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LASAR: 潜在認知マップによる時空間推論の実現VLA2026/5/16
エージェントが空間構造の内部モデルを獲得するよう促すため、二重記憶システムと対照学習を導入し、VLN-CEやVSI-Benchで性能を向上させた。
- DreamSAC: 対称性探索によるハミルトン世界モデルの学習世界モデル2026/3/8
物理法則の不変性を能動的に探索する「対称性探索」と、ハミルトン力学に基づく世界モデルを組み合わせ、外挿一般化を実現するフレームワークを提案した。
- TAG: 物体中心推論のためのターゲット非依存ガイダンスによるVLAポリシーの安定化VLA2026/3/1
VLAポリシーが散らかった環境で誤った物体や位置を掴む問題を、物体を消した観察との差分を利用した推論時ガイダンスで改善する手法を提案。
- RADAR: 実世界ダイナミクス・空間物理知能・自律評価による視覚言語行動モデルの汎化ベンチマークVLA2026/2/1
VLAモデルの実世界汎化を評価するため、物理ダイナミクス・空間推論タスク・3D指標による完全自律評価を統合したベンチマークRADARを提案し、既存モデルを監査した。
- 視覚言語行動モデルのための安定した言語ガイダンスVLA2026/1/1
VLAモデルが言語の言い回しの変化に弱い「モダリティ崩壊」を解決するため、意味意図と視覚的アフォーダンスを分離する確率的フレームワークRSSを提案し、敵対的な言語摂動下でも頑健な操作性能を実現した。
- STORM: 探索誘導型生成ワールドモデルによるロボットマニピュレーションマニピュレーション2025/12/1
拡散ベースの行動生成・動画予測・MCTS探索を統合し、視覚的ロールアウトで先読みしながら操作計画を立てるフレームワークを提案。SimplerEnvで成功率51.0%のSOTAを達成。
- E0: Tweedie離散拡散によるVLAモデルの汎化性と細粒度制御の向上VLA2025/11/1
量子化された行動トークン上でTweedie離散拡散を行うVLAフレームワークE0を提案し、視点摂動拡張と合わせて多様な環境での汎化と細かい制御を実現した。
- 動作から行動へ:ヒューマノイド生成行動制御の階層的モデリング行動生成2025/6/1
LLMが生成する階層的行動計画と動作を整合させ、人間の多様な行動を生成する統合フレームワークGBCを提案し、階層的計画付きデータセットGBC-100Kを構築した。
- Continuous Transition: Improving Sample Efficiency for Continuous Control Problems via MixUp2020/11/1