Yurong You
収録論文 9本 ・ フィジカルAI/ロボット学習
自動運転VLA自動運転VLA自動運転/VLAsim2real3D検出
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 計画整合型トークン圧縮による長文脈自動運転自動運転2026/6/1
自動運転のためのモノリシックな視覚行動モデルにおいて、長期の文脈を圧縮する際に計画情報を活用するフレームワークを提案し、成功率を向上させた。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- 自動運転における構造化Chain-of-Thoughtの高速化VLA2026/2/1
自動運転のVLAモデル向けに、Chain-of-Thought推論を依存グラフに分解し並列デコードすることで、精度を保ちつつ3〜4倍高速化する手法を提案。
- 反事実的VLA:適応的推論を備えた自己反省型視覚-言語-行動モデルVLA2025/12/1
自動運転VLAモデルが計画した行動を反事実的に推論して修正する自己反省フレームワークを提案し、軌道精度と安全性を向上させた。
- 潜在連鎖推論によるエンドツーエンド運転の世界モデリング自動運転VLA2025/12/1
運転行動の推論を自然言語ではなく、行動と整合した潜在空間で行うLCDriveを提案し、推論速度・軌道品質・強化学習の効果を向上させた。
- Alpamayo-R1: 長尾シナリオにおける汎化可能な自動運転のための推論と行動予測の橋渡し自動運転/VLA2025/11/1
視覚言語行動モデルに因果連鎖推論を組み込み、拡散ベースの軌道デコーダと強化学習を組み合わせることで、長尾の安全臨界シナリオでの自動運転計画精度と推論品質を向上させた研究。
- トライプレーンによる効率的なマルチカメラトークン化とエンドツーエンド自動運転自動運転2025/6/1
自動運転向けに、複数カメラの画像をトライプレーン表現で効率的にトークン化し、トークン数を最大72%削減して推論を高速化する手法を提案。
- 外挿的な都市ビュー合成ベンチマークsim2real2024/12/1
自動運転向けの新規視点合成(NVS)において、訓練視点から大きく外れた視点での性能を評価する初のベンチマークEUVSを構築し、既存手法が訓練視点に過適合しやすいことを示した。
- 過去のLiDARデータを活用した単眼3D検出器の性能向上3D検出2024/4/1
推論時に同じ場所を過去に走行した未ラベルのLiDARスキャンを利用し、非同期LiDARから特徴を抽出して単眼3D検出精度を最大9AP向上させるAsyncDepthを提案。