Max Smith
収録論文 3本 ・ フィジカルAI/ロボット学習
世界モデルVLAロコマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GrndCtrl: 自己教師あり報酬アライメントによる世界モデルの接地世界モデル2025/12/1
動画世界モデルを幾何・知覚報酬で強化学習的に事後学習し、身体性ナビゲーションで空間的一貫性と安定性を高める手法を提案。
- はさみを持って走るな:VLAモデルは枝刈りで壊れるが回復可能VLA2025/10/1
VLAモデルを枝刈りすると性能が大きく劣化し安全性違反も増えるが、重み空間で密モデルと枝刈りモデルを一度補間して補正項を計算する学習不要の手法GLUESTICKにより、効率を保ちつつ成功率を回復できることを示した。
- StageACT: 段階条件付き模倣によるロバストなヒューマノイドのドア開けロコマニピュレーション2025/9/1
ドア開けのような部分的観測下の長期タスクに対し、タスク段階を入力に加える模倣学習フレームワークを提案し、実環境のヒューマノイドで未見ドアの成功率を55%に向上させた。