Ziheng Xi
収録論文 6本 ・ フィジカルAI/ロボット学習
触覚/操作VLAオフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 器用なロボット操作のための人間中心の転移可能な触覚事前学習触覚/操作2026/7/1
人間の触覚データを大規模に収集し、ロボット操作のための触覚事前学習手法を提案した論文。
- Being-H0.7: 自己中心視点ビデオからの潜在世界行動モデルVLA2026/5/1
将来のフレーム生成をせずに、潜在空間での未来推論をVLAポリシーに組み込む新しいモデルを提案。訓練時のみ未来情報を使う二重分岐設計により、推論時は現在の観察のみで将来を考慮した行動決定を実現し、シミュレーションと実世界タスクで高性能を達成した。
- 視覚言語行動モデルにおける具現化推論の幻想を暴くVLA2026/4/1
標準ベンチマークの成功率と真の具現化推論能力の乖離を検証するため、因果介入と運動学的分離を用いた診断ベンチマークBeTTERを導入し、最先端VLAモデルが動的シナリオで重大な失敗を起こすことを実証した。
- 後続遷移の再重み付けによる保守的オフラインロボット方策学習オフライン強化学習2026/3/1
ロボットのオフライン事後学習で、各サンプルの行動後の結果に基づいて学習への影響度を再重み付けする手法PTRを提案。不均一なデータセットでの保守的な適応を改善する。
- Being-H0.5: 人間中心のロボット学習をスケールさせ、異なる身体間の汎化を実現VLA2026/1/1
人間の動作データを共通言語として扱い、35,000時間超・30種のロボット身体のデータで学習するVLA基盤モデルを提案し、異なる身体間での汎化性能を大幅に向上させた。
- ControlVLA: 事前学習済み視覚言語行動モデルのための少数ショット物体中心適応VLA2025/6/1
ControlNet風のアーキテクチャで物体中心表現を導入し、10〜20回のデモンストレーションだけで多様な実世界操作タスクに適応できるフレームワークを提案。