Yi Zeng
収録論文 7本 ・ フィジカルAI/ロボット学習
セキュリティ/攻撃VLA/安全性評価状態推定VLAナビゲーション模倣学習/拡散ポリシー
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TempJail: 字幕スケジューリングによる大規模視覚言語モデルへの時間的ジェイルブレイク攻撃セキュリティ/攻撃2026/8/20
動画内の字幕の表示タイミングを最適化することで、大規模視覚言語モデルに有害な応答を引き起こすブラックボックス攻撃手法を提案した。
- ForesightSafety-VLA: 視覚・言語・行動モデルのための統合診断安全ベンチマークVLA/安全性評価2026/6/1
VLAモデルの安全性を評価するための診断ベンチマークを提案し、物理的相互作用・指示・視覚の3側面から13カテゴリの安全分類を定義して、シーン構造・言語コマンド・視覚観察の変動下でプロセスレベルのリスクを測定する。
- 自然勾配ベイズフィルタリング:力学系のための幾何認識フィルタ状態推定2026/5/1
ガウス分布の統計多様体上で自然勾配降下を用いて事後分布を更新する幾何認識型ガウスフィルタ(NANOフィルタ)を提案し、線形ガウス系ではカルマンフィルタと一致することを示した。衛星姿勢推定やロボットの状態推定などで有効性を実証している。
- フローマッチング方策の強化学習ファインチューニングによる視覚言語行動モデルの改善VLA2025/10/1
フローマッチングベースのVLAモデルに対し、重要度サンプリングを条件付きフローマッチング目的の変化で再定式化したFPOを提案し、オンライン強化学習による安定したファインチューニングを実現した。
- AINav: 大規模言語モデルを用いた適応的インタラクティブナビゲーションナビゲーション2025/3/1
LLMによるタスク計画と強化学習によるスキルライブラリを組み合わせ、環境と能動的に相互作用して経路を切り開く適応的ナビゲーション手法を提案。
- 変調トランスフォーマーに基づく拡散ポリシーモデルMTDP模倣学習/拡散ポリシー2025/2/1
拡散ポリシーにトランスフォーマーを組み込む際の条件統合の課題を解決するModulated Attentionを提案し、ロボット操作タスクの成功率を向上させた。
- スパイキングTransformer拡散ポリシーによる脳模倣行動生成VLA2024/11/1
スパイキングニューラルネットと拡散モデルを組み合わせたTransformerベースのポリシーを提案し、ロボット操作タスクで従来手法を上回る性能を示した。