Jingkai Jia
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション触覚/VLA/操作VLA/攻撃/転移性操作/ベンチマーク
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- トークン重要度を超えて:効率的な視覚-言語-行動推論のための空間スキャフォールドの保持VLA2026/9/29
視覚トークンの空間的な広がりを保つことで、視覚-言語-行動モデルの推論を高速化する訓練不要のトークン枝刈り手法を提案。
- ロボット操作のための軌道レベル連続行動表現マニピュレーション2026/8/25
制御周波数に依存せず、固定時間間隔の行動軌跡を連続潜在トークンで表現する新しい行動表現フレームワークCATを提案し、LIBEROや実機の長期的操作タスクで既存手法より高い成功率を達成した。
- EDAR: ロボット操作のための環境依存行動表現の学習マニピュレーション2026/7/1
ロボット操作において、行動トークンを実行可能な制御構造と環境条件付きの視覚的結果に基づいて表現する手法を提案し、長期的な操作タスクでのポリシー学習を改善した。
- 接触を伴うロボット操作のための表現整合型触覚グラウンディング触覚/VLA/操作2026/7/1
触覚強化型VLAポリシーにおいて、将来の触覚状態を予測する中間表現の位置を特定し、軽量な潜在触覚予測器(LTP)を導入して行動表現と接触結果を整合させる手法を提案した。実機の接触を伴う操作タスクで有効性を実証した。
- VLA-Hijack: 視覚的プロプリオセプション乗っ取りによる視覚言語行動モデルへの転移可能なパッチ攻撃VLA/攻撃/転移性2026/5/27
VLAモデルが動作計画前にロボットアームの自己位置を視覚で特定する共通の脆弱性を突き、注意誘導型プロプリオセプション抑制とマルチモーダル注入によりパッチを偽の身体として埋め込む転移可能な攻撃手法を提案した。
- LongBench: 実世界の長時間ホライズンタスクにおけるロボット操作ポリシーの評価操作/ベンチマーク2026/4/1
実世界の長時間操作タスクを評価するベンチマークLongBenchを提案し、実行堅牢性と文脈依存推論の要因を分離して分析した。
- ロボットマニピュレーションのための高速視覚運動ポリシーマニピュレーション2025/10/1
エネルギーMLPを用いて単一順伝播でマルチモーダル行動を予測し、高頻度・低リソース環境で高精度な操作を実現するEnergy Policyを提案した。