Jongwoo Park
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA/動作生成VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SMILE: 長期的VLA実行のための滑らかな動作生成VLA/動作生成2026/8/29
VLAモデルの長期的な動作実行精度を向上させるため、Bスプライン係数を予測して滑らかな動作列を生成する手法SMILEを提案。複数のベースラインに適用し、精度と推論効率を改善。
- IVRA: 学習不要のヒント誘導による視覚トークン関係改善でロボット行動方策を強化VLA2026/1/1
VLAモデルの視覚エンコーダ内の親和性情報を推論時に注入し、再学習なしで視覚トークンの空間理解を改善する手法を提案。
- ピクセルモーションを汎用表現としたロボット制御フレームワークLangToMoVLA2025/5/1
画像拡散モデルでテキストからピクセルモーションを生成し、それを中間表現としてロボット動作に変換する二重システム構成の視覚-言語-行動フレームワークを提案。
- LLaRA:視覚言語モデルをロボット制御に転用する対話型ポリシー学習VLA2024/6/1
ロボットの行動を視覚と言語の対話として扱い、既存の模倣学習データから自動で対話形式の学習データを生成して視覚言語モデルを微調整し、ロボット制御に転用する手法を提案した。