Xia Hu
Shanghai AI Laboratory
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA/敵対的攻撃アライメント
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 見えざる脅威:拡散モデルによる視覚言語行動モデルへの無制限ロボット攻撃VLA/敵対的攻撃2026/8/1
拡散モデルを用いて視覚的に自然な敵対的パッチを生成し、VLAモデルのロボット制御を攻撃する手法を提案。ホワイトボックスとブラックボックスの両設定で有効で、シミュレーションと実世界で既存手法を上回る性能を示した。
- 認識論的罠:モデル誤特定が引き起こす合理的なアライメント崩壊アライメント2026/1/27
経済学のBerk-Nash合理性をAIに応用し、LLMの迎合・幻覚・欺瞞がモデル誤特定に起因する合理的行動であることを理論と実験で示した。