Xin Wen
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 凍結VLAポリシーのための達成基盤メモリによる閉ループエージェントVLA/操作2026/8/30
凍結された視覚-言語-行動(VLA)ポリシーに、物理的証拠で検証されたサブゴール進行ポインタを持つ軽量メモリを追加し、開ループ実行を閉ループ化するフレームワークを提案。
- ComSim: 構成シミュレーションによるスケーラブルな実世界ロボットデータ生成sim2real2026/4/1
古典的シミュレーションとニューラルシミュレーションを組み合わせ、少量の実データから多様な実世界データを生成するハイブリッド手法を提案。sim2realギャップを低減し、実世界でのポリシー学習成功率を向上させる。
- 参照認識型ビジュモータポリシー学習による閉ループ操作操作2026/4/1
人間や高次プランナーからの疎な参照点を即時統合し、予期せぬ状況に適応できる閉ループ操作フレームワークReVを提案。拡散ヘッドの結合と軌道誘導戦略により、専門家デモのみで学習しつつ動的な軌道再計画を実現。
- TouchGuide: 触覚ガイダンスによる視覚運動ポリシーの推論時ステアリング触覚2026/1/1
事前学習済みの視覚運動ポリシーの生成過程に、触覚に基づく接触物理モデルで介入し、接触を伴う繊細な操作を高精度化する手法を提案。低コストな触覚データ収集系TacUMIも開発した。
- 軌道不要の生成モデルとセグメントマップ拡散による衝突検出フレームワーク交通監視/衝突検出2025/11/1
軌道取得や車両追跡を必要とせず、道路セグメントマップの将来予測を拡散モデルで生成し、実測との差分から衝突を検出する2段階手法を提案。
- 学ぶほど賢く枝刈り:微分可能なトークン枝刈りによる効率的な視覚-言語-行動モデルVLA2025/9/1
VLAモデルの視覚トークンを微分可能なGumbel Softmaxで動的に枝刈りし、追加パラメータなしで計算量を削減しつつ成功率を向上させるLightVLAを提案。
- TransDiffuser: エンドツーエンド自動運転のための脱相関マルチモーダル表現による多様な軌道生成自動運転/軌道生成2025/5/1
拡散モデルによる軌道生成のモード崩壊を、事前定義軌道語彙やシーンプライアなしで解決するため、脱相関マルチモーダル表現最適化を導入したエンコーダ・デコーダ型生成軌道計画モデルを提案。
- ロボット学習のための事前学習済み視覚モデルのデータ中心再検討VLA2025/3/1
ロボット学習用の視覚モデルにおいて、非物体中心データでも物体中心表現を獲得できるSlotMIMを提案し、認識・シーン理解・ロボットタスクで性能を向上させた。
- 人間のフィードバック強化学習によるパーソナライズ運転スタイルの学習自動運転2025/3/1
生成的な軌道モデルを人間のフィードバックで微調整し、多様な運転スタイルに合わせた軌道生成を可能にするTrajHFを提案。
- Mixture of Expertsによる自動運転モーションプランナーの汎化自動運転/プランニング2024/10/1
ViTエンコーダとMixture-of-Experts因果Transformerを組み合わせたスケーラブルなモーションプランナーSTR2を提案し、NuPlanデータセットで従来手法より高い汎化性能とスケーラビリティを示した。