Yuqing Wen
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA自動運転/生成データ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットシーンクローニング:視覚プロンプト編集による操作タスクのゼロショットシーン適応の推進マニピュレーション2026/3/1
既存のロボット操作軌道を編集してシーン固有の適応を実現する手法を提案し、視覚プロンプトと条件注入モジュールにより正確でシーン整合性のあるサンプル生成を行い、ポリシーの汎化を向上させる。
- IntentionVLA: 人間とロボットのインタラクションのための汎用かつ効率的な意図推論VLA2025/10/1
意図推論・空間グラウンディング・簡潔な身体性推論を組み合わせたカリキュラム学習と効率的推論機構により、間接的な指示から人間の意図を推論して行動生成するVLAフレームワークを提案。
- ManiAgent:汎用ロボットマニピュレーションのためのエージェント型フレームワークマニピュレーション2025/10/1
複数のエージェントが協調して環境認識・サブタスク分解・行動生成を行い、複雑なマニピュレーションを効率的にこなすエージェント型アーキテクチャを提案した論文。
- LLaDA-VLA:視覚言語拡散アクションモデルVLA2025/9/1
拡散ベースの視覚言語モデルをロボットマニピュレーションに適応させた初のVLAモデルを提案し、特殊トークン分類と階層的アクション復号により従来手法を上回る性能を実現した。
- ROSA: ロボット状態を活用した視覚言語と行動のアライメントVLA2025/6/1
ロボットの状態推定データを自動取得してVLAモデルの訓練に組み込み、視覚言語空間と行動空間のずれを埋めることで、少ないデータでも高性能・高汎化を実現する手法を提案。
- SubjectDrive: 被写体制御による自動運転向け生成データのスケーリング自動運転/生成データ2024/3/1
被写体を制御できる生成モデルを開発し、多様な生成データを大量に作ることで自動運転の認識モデルの性能を継続的に向上させられることを示した。
- ADriver-I: A General World Model for Autonomous Driving2023/11/1