Giscard Biamby
収録論文 3本 ・ フィジカルAI/ロボット学習
画像改ざん検出VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 画像改ざん位置特定の多軸解析画像改ざん検出2026/5/19
画像編集技術の進歩に伴い、高度な改ざん画像の検出が課題となっている。本論文では、異なる視覚領域での改ざん検出の堅牢性を評価するための包括的ベンチマーク「AUDITS」を紹介し、拡散モデルを用いた多様な改ざん画像を含む53万枚以上のデータセットを構築した。
- 4D表現で事前学習する自己回帰ロボットモデルVLA2025/2/1
人間の動画から得た3D点追跡の4D表現を活用し、ロボット制御に効率的に転移できる自己回帰モデルARM4Rを提案した。
- LLARVA: 視覚-行動インストラクションチューニングによるロボット学習の強化VLA2024/6/1
構造化プロンプトで多様なロボットタスクを統合するインストラクションチューニング手法と、中間2D表現「ビジュアルトレース」の予測により視覚と行動を整合させ、RLBenchと実機Frankaで高い汎化性能を示した研究。