Zhenhan Yin
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAロボット基盤モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Magic-W0:物理知能のための構造化ワールド・アクション基盤モデルVLA2026/9/30
ロボットの行動生成と環境の物理的状態変化を、現在状態・遷移・未来状態からなる構造化表現で同時にモデル化する基盤モデルを提案。大規模データで事前学習し、行動仮説と世界予測を層レベルで相互に作用させる。
- リアルタイムVLAに向けて:段階認識型2ステップフローデノイジングとシステムレベル評価VLA2026/9/30
VLAモデルの推論とロボット実行の速度ギャップを分析し、フローデノイジングを2段階に削減する手法と分散リアルタイム実行フレームワークを提案、衣類折り畳みタスクで評価した。
- WSA$_1$: 3D中心の世界・空間・行動モデルによる汎用ロボット制御ロボット基盤モデル2026/7/1
ロボット基盤モデルに3D世界の物理ダイナミクスと行動の因果関係を学習させる新しいパラダイムを提案し、少ない実データで高い汎化性能を実現した。
- MiVLA: 人間とロボットの相互模倣事前学習による汎化可能な視覚-言語-行動モデルVLA2025/12/1
人間の手とロボットアームの動作類似性を利用し、人間とロボットの行動空間を双方向に整列させる相互模倣事前学習でVLAを訓練し、汎化性能を向上させた研究。