Lei Xu
収録論文 5本 ・ フィジカルAI/ロボット学習
画像フォレンジックVLA/強化学習VLA群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ForensicsTok: フォレンジック誘導トークン化モデリングによる画像改ざん位置特定画像フォレンジック2026/6/23
画像改ざん位置特定を自己回帰シーケンス生成として再構成し、トークンを直接マスクに変換する新しいデコーダと階層的専門家融合を導入して、MLLMベースの手法の精度を向上させた。
- dVLA-RL: 離散拡散ビジョン・ランゲージ・アクションモデルに対する軌跡上の強化学習VLA/強化学習2026/6/1
離散拡散型VLAモデルの強化学習を可能にするため、生成過程をマルコフ決定過程とみなし、軌跡の結合確率を目的関数とする手法を提案した。
- 専門性は独占する必要なし:視覚-言語-行動学習のための行動特化型Mixture of ExpertsVLA2025/10/1
事前学習済みVLAモデルの重みを継承し、フィードフォワード層をスパースなMoE層に置き換えて拡張するAdaMoEを提案。専門家選択と重み付けを分離することで協調的な専門家利用を実現し、計算効率を保ちつつ性能を向上させた。
- HGIC: 効率的でスケーラブルなマルチUAV運用のためのハンドジェスチャー対話型制御システム群制御2024/3/1
コンピュータビジョンで手のジェスチャーをモジュール式コマンドに変換し、複数ドローンの動作制御を直感的かつスケーラブルに行うシステムを開発した。
- Accelerating Integrated Task and Motion Planning with Neural Feasibility Checking2022/3/1