Xuanye Fei
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAマルチモーダルHRI
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルへの普遍的敵対攻撃:ロボット操作における脆弱性の悪用VLA2026/9/30
ロボットの視界に置くだけでタスク成功率を大幅に下げる最適化された表面テクスチャを持つ球体を提案し、VLAモデルの軌道計画・実行・制御を同時に妨害する攻撃を実機とシミュレーションで検証した。
- 音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワークマルチモーダルHRI2026/2/1
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。