Fei Shen
収録論文 5本 ・ フィジカルAI/ロボット学習
画像検出動画フォレンジック自動運転/VLAVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DailyBench:現代の生成モデルによるAI生成・改変画像のための統合ベンチマーク画像検出2026/7/27
最新の生成モデルに対応した、AI生成画像と物体レベルの改変画像を評価する統合ベンチマークDailyBenchを提案し、既存の検出器の汎化性能が大幅に低下することを示した。
- 長尺動画における改ざんセグメントの説明可能なフォレンジック解析動画フォレンジック2026/6/1
未編集の長尺動画に埋め込まれたAI生成セグメントを検出・位置特定し、その理由を説明する新しいタスクとベンチマーク、ベースライン手法を提案した論文。
- CoC-VLA: 因果連鎖型視覚言語行動モデルによる説明可能な自動運転のための敵対的ドメイン転移自動運転/VLA2025/11/1
シミュレーションで得た長尾ケース対応能力を実世界へ転移するため、因果連鎖推論を行う視覚言語モデルを教師・生徒・識別器で構成した敵対的転移フレームワークを提案した論文。
- Reasoning-VLA:自動運転向けの高速で汎用的な視覚-言語-行動推論モデルVLA2025/11/1
学習可能な行動クエリと推論強化された視覚言語特徴を並列に用いて連続行動軌道を生成するVLAフレームワークを提案し、8つの自動運転データセットを統合して学習・強化学習微調整を行い、最先端の性能と汎化性、高速推論を実現した。
- 純粋な視覚言語行動(VLA)モデル:包括的サーベイVLA2025/9/1
視覚言語行動(VLA)モデルの研究を体系的に整理し、自己回帰・拡散・強化学習などのパラダイム分類やデータセット・ベンチマークを概観したサーベイ論文。