Wenke Huang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA/セキュリティ共創/音楽ロボティクスVLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TrustVLA:メカニズムに基づく推論時防御による視覚言語行動モデルのバックドア対策VLA/セキュリティ2026/7/1
視覚言語行動(VLA)モデルに対するバックドア攻撃を、内部メカニズムの分析に基づいて推論時に検出・防御する手法を提案した。
- Co-policy: 人間とロボットによる応答的な音楽共創のためのフレームワーク共創/音楽ロボティクス2026/6/1
音楽セマンティクスを物理的な演奏動作に結びつける、人間とロボットの音楽共創フレームワークを提案。意味理解、音楽変奏、視覚運動実行を分離し、低遅延で応答的な演奏を実現する。
- 注意が裏切るとき:視覚トークン再構成によるロボットポリシーのバックドア攻撃消去VLA2026/2/1
VLAモデルのバックドアが深層注意を乗っ取る仕組みを解明し、テスト時に異常トークンを検出・マスクしてトリガー除去画像を再構成することで、再学習なしに攻撃を無効化する防御手法Beraを提案した。
- 汎化可能な幾何学的事前知識と再帰スパイキング特徴学習によるヒューマノイドロボットマニピュレーションマニピュレーション2026/1/1
視覚言語モデルに軽量な2D幾何学的バイアスを組み込み、再帰スパイキングネットワークで時空間一貫性を学習することで、未見環境での汎化と少ない実演からのデータ効率的な動作生成を実現した。
- RGMP: 汎化可能なヒューマノイドロボット操作のための再帰的幾何事前マルチモーダルポリシーマニピュレーション2025/11/1
視覚言語モデルに幾何学的な事前知識を組み込み、ガウス過程でロボットと対象物の関係を再帰的に符号化することで、少ないデータで未知環境にも汎化するヒューマノイド操作を実現した。