Xiyang Wu
収録論文 9本 ・ フィジカルAI/ロボット学習
VLA社会的ナビゲーション/VLAVLA/セキュリティ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Causeway: VLAポリシーにおける指示切替時のタスク到達性回復VLA2026/9/25
VLAポリシーで別タスク実行後に新しい指示を与えると失敗しやすい問題に対し、学習不要の推論時介入で目標タスクの再開を可能にする手法を提案。
- 見たものに基づいて行動する:視覚言語行動モデルにおける安全な社会的ナビゲーションの実現社会的ナビゲーション/VLA2026/6/1
事前学習済みの視覚言語行動(VLA)モデルが歩行者と障害物の区別や衝突予測信号を内部表現に持つことを利用し、注釈不要の2段階ポストトレーニング手法SALSAを提案。反事実的なシーンと将来リスクの教師信号で行動生成と潜在表現を整合させ、近接衝突を86.4%削減した。
- SABER: 視覚言語行動モデルに対するステルスなエージェント型ブラックボックス攻撃フレームワークVLA/セキュリティ2026/3/1
VLAモデルへの指示文の小さな改変でロボットの行動を劣化させる攻撃を自動生成するフレームワークを提案し、LIBEROベンチマークで成功率低下などの効果を実証した。
- 大規模視覚言語モデルの最新動向:アラインメント、ベンチマーク、評価、課題に関するサーベイVLA2025/1/1
2025年までの主要な視覚言語モデル(VLM)のモデル情報、アーキテクチャの変遷とアラインメント手法、ベンチマークと評価指標、幻覚や公平性などの課題を体系的にまとめたサーベイ論文。
- FALCON: 未来予測と物体中心の文脈事前学習によるUAV行動認識VLA2024/9/1
UAV映像の行動認識に向け、物体検出を事前学習時のみに用いて背景の影響を抑え、物体中心の短期・長期未来再構成を組み合わせた自己教師あり学習手法を提案。
- LLM/VLM制御ロボティクスの脆弱性VLA2024/2/1
LLMやVLMで制御されるロボットが入力のわずかな変化に弱く、タスク成功率が最大22.2%低下することを実験で示した研究。
- LANCAR: Leveraging Language for Context-Aware Robot Locomotion in Unstructured Environments2023/10/1
- iPLAN: Intent-Aware Planning in Heterogeneous Traffic via Distributed Multi-Agent Reinforcement Learning2023/6/1
- FireCommander: An Interactive, Probabilistic Multi-agent Environment for Heterogeneous Robot Teams2020/11/1