Jiadong Xu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA/触覚/操作VLA/操作VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AT-VLA: 適応的触覚注入による視覚言語行動モデルのフィードバック反応向上VLA/触覚/操作2026/5/1
接触を伴う操作タスクで視覚言語行動モデルの性能を高めるため、適応的に触覚情報を注入する仕組みと、高速な触覚反応を可能にする二重ストリーム構造を提案した。
- AnchorVLA4D: ロボット操作のためのアンカーベース時空間視覚言語行動モデルVLA/操作2026/3/1
視覚アンカーを用いて、操作中の空間認識と時間的文脈を強化する新しいVLAモデルを提案。初期シーンのアンカー画像と軽量な空間エンコーダを追加し、追加センサなしで性能を向上させた。
- MLA: ロボットマニピュレーションにおけるマルチモーダル理解と予測のためのマルチセンサリー言語行動モデルVLA2025/9/1
2D画像・3D点群・触覚を位置対応で統合し、将来のマルチセンサリー情報を予測する言語行動モデルを提案。接触の多い実世界タスクで従来の2D/3D VLAを大きく上回る。
- Imagine2Act: 想像上の目標を用いた物体-動作の運動整合性によるロボットマニピュレーションマニピュレーション2025/9/1
言語指示から想像した目標画像と3D点群を生成し、物体の変形とエンドエフェクタ動作を整合させることで、高精度な物体再配置タスクを実現する模倣学習フレームワークを提案した。