Bryan A. Plummer
収録論文 2本 ・ フィジカルAI/ロボット学習
画像改ざん検出VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 画像改ざん位置特定の多軸解析画像改ざん検出2026/5/19
画像編集技術の進歩に伴い、高度な改ざん画像の検出が課題となっている。本論文では、異なる視覚領域での改ざん検出の堅牢性を評価するための包括的ベンチマーク「AUDITS」を紹介し、拡散モデルを用いた多様な改ざん画像を含む53万枚以上のデータセットを構築した。
- SAT: マルチモーダル言語モデルのための動的空間適性トレーニングVLA2024/12/1
3Dシミュレータを用いて静的・動的な空間推論を含む17.5万件のQAペアと2万シーンからなるデータセットSATを構築し、マルチモーダル言語モデルの空間認識能力を訓練する手法を提案した。