Xuetao Li
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルへの普遍的敵対攻撃:ロボット操作における脆弱性の悪用VLA2026/9/30
ロボットの視界に置くだけでタスク成功率を大幅に下げる最適化された表面テクスチャを持つ球体を提案し、VLAモデルの軌道計画・実行・制御を同時に妨害する攻撃を実機とシミュレーションで検証した。
- ICI-VLA: 時空間的に整列したデモによる文脈内模倣を用いた視覚言語行動モデルVLA2026/9/7
追加学習なしで、テスト時にデモを文脈として与えることで新しい操作タスクに適応できるVLAモデルの訓練・検索フレームワークを提案した。
- TrustVLA:メカニズムに基づく推論時防御による視覚言語行動モデルのバックドア対策VLA/セキュリティ2026/7/1
視覚言語行動(VLA)モデルに対するバックドア攻撃を、内部メカニズムの分析に基づいて推論時に検出・防御する手法を提案した。
- Co-policy: 人間とロボットによる応答的な音楽共創のためのフレームワーク共創/音楽ロボティクス2026/6/1
音楽セマンティクスを物理的な演奏動作に結びつける、人間とロボットの音楽共創フレームワークを提案。意味理解、音楽変奏、視覚運動実行を分離し、低遅延で応答的な演奏を実現する。
- E²DT:経験認識サンプリングによる効率的かつ効果的なロボット操作のためのディシジョン・トランスフォーマー強化学習2026/5/1
ロボット操作の強化学習において、ディシジョン・トランスフォーマーの性能を向上させるため、経験の質と多様性を考慮したサンプリング手法を提案した論文。
- 音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワークマルチモーダルHRI2026/2/1
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。
- 注意が裏切るとき:視覚トークン再構成によるロボットポリシーのバックドア攻撃消去VLA2026/2/1
VLAモデルのバックドアが深層注意を乗っ取る仕組みを解明し、テスト時に異常トークンを検出・マスクしてトリガー除去画像を再構成することで、再学習なしに攻撃を無効化する防御手法Beraを提案した。
- 汎化可能な幾何学的事前知識と再帰スパイキング特徴学習によるヒューマノイドロボットマニピュレーションマニピュレーション2026/1/1
視覚言語モデルに軽量な2D幾何学的バイアスを組み込み、再帰スパイキングネットワークで時空間一貫性を学習することで、未見環境での汎化と少ない実演からのデータ効率的な動作生成を実現した。
- RGMP: 汎化可能なヒューマノイドロボット操作のための再帰的幾何事前マルチモーダルポリシーマニピュレーション2025/11/1
視覚言語モデルに幾何学的な事前知識を組み込み、ガウス過程でロボットと対象物の関係を再帰的に符号化することで、少ないデータで未知環境にも汎化するヒューマノイド操作を実現した。
- DexFlow: 巧みな手のポーズリターゲティングとインタラクションの統合手法マニピュレーション2025/5/1
人間の手と物体のデータを組み合わせ、微分損失制約と接触マップ生成により、ロボットハンドの高精度で自然な操作データを生成するパイプラインを提案した。
- 触覚センシングと適応スキルによるロバスト把持戦略の学習触覚2024/11/1
人間のデモンストレーションと触覚フィードバックを用いて、外乱に耐えるロバストな把持を実現する適応的把持ポリシーを学習した研究。
- ガイド付き自己注意行動クローニングによる軟体物操作スキルの汎化学習マニピュレーション2024/10/1
点群から意味特徴を抽出し、ガイド付き自己注意と二段階ファインチューニングで軟体物の操作スキルを汎化可能に学習する行動クローニング方策を提案した。