Chenyang Si
収録論文 4本 ・ フィジカルAI/ロボット学習
画像偽造検出マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GIFTBench:画像偽造位置推定における汎化性能の診断とモデル設計への指針画像偽造検出2026/10/1
多様な偽造条件を軸別に評価できる大規模ベンチマークGIFTBenchを構築し、汎化性能の診断と学習リソースとしての有効性を示すとともに、知見を活かした検出・位置推定フレームワークForenScopeを提案した。
- SafeLoop: 視覚言語行動マニピュレーションのためのリスク認識ロールバックマニピュレーション2026/9/22
VLAモデルのパラメータを変えずに外部ラッパーとして危険予測とロールバック復帰を追加し、衝突や物体落下を約70%削減しつつタスク成功率を維持する手法を提案。
- 身体を知る:VLMによる直接的・自己改善的なロボット制御のためのハーネスVLA2026/9/22
視覚言語モデルの重みを固定したまま、ロボットの身体構造に関する知識を明示化・更新可能にし、行動選択と過去の経験解釈を改善するフレームワークKnowBodyを提案。実機4タスクで成功率75%を達成。
- BFA++: マルチビュー視覚言語行動モデルのための階層的ベスト特徴認識トークンプルーニングVLA2026/2/1
VLAモデル向けに、視点内・視点間の2段階重要度予測で動的にトークンを削減し、マルチビュー入力の計算効率と操作成功率を両立させるフレームワークを提案した。