Sedrick Keh
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SUAVE: マスク拡散による統合映像行動モデルVLA2026/10/2
言語・映像・行動を離散トークンの共有系列で扱うマスク拡散トランスフォーマーを提案し、推論時のマスク選択で世界モデル・ロボット方策・映像行動モデルを単一ネットワークで実現した。
- VLA Foundry: 視覚言語行動モデル訓練のための統合フレームワークVLA2026/4/1
LLM、VLM、VLAの訓練を単一コードベースで統合するオープンソースフレームワークを提案し、スクラッチからの訓練と事前学習済みバックボーンを用いた訓練の両方をサポートし、シミュレータ上で評価した。
- マルチタスク巧みな操作のための大規模行動モデルの慎重な検証マニピュレーション2025/7/1
大規模行動モデル(LBM)をシミュレーションと実世界で厳密に評価し、マルチタスク事前学習が単一タスクより成功率・堅牢性・データ効率を高めることを統計的に示した。