Yan Li
収録論文 7本 ・ フィジカルAI/ロボット学習
セキュリティ/VLA敵対的攻撃/VLMVLA制御・最適化3D再構成SLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TrapVLA: 設定された失敗モードへのVLAモデルのトラッピングセキュリティ/VLA2026/8/27
視覚言語行動モデルに対するバックドア攻撃の新タスクを提案し、テキストトリガーで特定の失敗パターンを誘発する手法を開発した。
- 注意ハイジャック:視覚言語モデルにおけるクエリ横断的な応答操作敵対的攻撃/VLM2026/5/17
視覚言語モデルに対する敵対的攻撃で、単一の摂動が多様なユーザークエリに対して効果を維持する「クロスクエリ応答操作」を実現する手法を提案。内部の注意分布を画像優位なパターンに固定することで、クエリの文言への依存を減らし、転移性を向上させる。
- ST-π: ロボット操作のための構造化時空間VLAモデルVLA2026/4/1
視覚・言語・行動モデルに時空間の明示的な構造化を導入し、サブタスクと空間・時間の接地を計画するVLMと、それに基づき行動を生成する専門家モジュールを組み合わせたロボット操作モデルを提案した。
- 異分散ベイズ最適化による動的PIDチューニングでUAVの高精度・ロバスト軌道追従を実現制御・最適化2025/12/1
入力依存のノイズ分散を考慮した異分散ベイズ最適化とPID制御を組み合わせ、2段階最適化でUAVの軌道追従精度とロバスト性を大幅に向上させた。
- IPR-1: 対話型物理推論器VLA2025/11/19
1000以上の多様なゲームで物理法則と因果関係を学習し、世界モデルの予測とVLMの推論を統合して未知のゲームにもゼロショットで対応するエージェントを提案。
- Active3D: 階層的不確かさ定量化による能動的高忠実度3D再構成3D再構成2025/11/1
不確かさを階層的に推定しながら次に見るべき視点を計画し、高精度な3D再構成を能動的に行うフレームワークを提案した。
- RiemanLine: 因子グラフ最適化のための3次元直線のリーマン多様体表現SLAM2025/8/1
平行線群の構造を活かし、3次元直線をリーマン多様体上で最小パラメータ化する手法を提案し、因子グラフ最適化に統合して姿勢推定と直線再構成の精度を向上させた。