Shengye Dong
Xi'an Jiaotong University
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA協調運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 時間周波数幾何クロスアテンションによるチャンク型視覚言語行動モデルの改善VLA2026/9/9
行動チャンクを学習可能なウェーブレット変換で時間周波数トークンに分解し、内積とウェッジ積を融合したクロスアテンションで位相間の直交的な関係を捉える、VLAポリシー向けの追加モジュールを提案。
- 周波数条件付きフローマッチングによる視覚-言語-行動モデルVLA2026/9/9
VLAモデルの行動生成をDCT周波数座標で行い、周波数ごとに条件付け・重み付けするFreqFMを提案。LIBERO等で性能向上と実機6タスクでの有効性を示した。
- 人間中心の協調運転:運転意図・状態・コンフリクトの統合協調運転2025/12/1
ドライバーの意図と状態を優先し、戦略レベルの意図考慮型軌道計画と強化学習による操作権限配分で人と車の協調運転を実現する手法を提案した。