Jonas Pai
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- mimic-video: VLAを超える汎化可能なロボット制御のためのビデオ行動モデルVLA2025/12/1
大規模動画モデルを事前学習に用い、その潜在表現からフローマッチングでロボットの低レベル行動を生成するVideo-Action Modelを提案。シミュレーションと実機のマニピュレーションでVLAを上回り、サンプル効率10倍・収束速度2倍を達成した。
- mimic-one:汎用ロボット巧緻性のためのスケーラブルなモデルレシピマニピュレーション2025/6/1
16自由度の腱駆動ハンドと拡散モデルを組み合わせ、遠隔操作で収集したデータから器用な操作を学習する実世界制御手法を提案。未見タスクで最大93.3%の成功率を達成。