Shen Chen
収録論文 3本 ・ フィジカルAI/ロボット学習
マルチモーダルLLM画像フォレンジック
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 鋭い目から専門家の頭脳へ:改ざんテキスト検出のためのMLLMへの専門知識の内部化マルチモーダルLLM2026/9/28
改ざんテキスト検出において、専門家モデルの細粒度な知覚能力をマルチモーダル大規模言語モデル(MLLM)に段階的に内部化する手法を提案し、ドメイン内外での検出性能を向上させた。
- ForensicsTok: フォレンジック誘導トークン化モデリングによる画像改ざん位置特定画像フォレンジック2026/6/23
画像改ざん位置特定を自己回帰シーケンス生成として再構成し、トークンを直接マスクに変換する新しいデコーダと階層的専門家融合を導入して、MLLMベースの手法の精度を向上させた。
- Modeling and Multi-objective Optimization of a Kind of Teaching Manipulator2018/1/1