Xun Xu
収録論文 4本 ・ フィジカルAI/ロボット学習
デジタルツイン/エージェントAIVLAベンチマーク
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 再構成可能な製造のための認知デジタルツインのエージェントAIによるセマンティックコミッショニングデジタルツイン/エージェントAI2026/9/8
マルチエージェントAIとRAG・MCPを組み合わせ、認知デジタルツインの構築・デバッグを自動化し、展開時間を数週間から約2時間に短縮した。
- 複雑な組立動作理解のための構成文脈ファインチューニングによる視覚言語モデルVLA2026/7/12
組立動作を動詞・対象・工具の要素に分解し、視覚言語モデルを要素ごとにファインチューニングして、ビデオから組立動作を高精度に認識する手法を提案した。
- Event-VLA: アクション条件付きイベント融合によるロバストな視覚言語行動モデルVLA2026/6/1
照明変化に弱い既存のVLAモデルに対し、イベントカメラのストリームをアクションクエリ経由で融合するEvent-VLAを提案し、低照度下での操作成功率を向上させた。
- PRISM: シミュレーション環境における意図を伴う計画と推論ベンチマーク2026/5/1
LLMベースの身体性エージェントの失敗原因を、知覚・推論・長期計画のどの能力に起因するかを診断するベンチマークPRISMを提案した論文。