Matthieu Cord
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Pictura: 運転のためのスケールでの視点ビュー自己対戦自動運転/自己対戦学習2026/7/1
GPU加速シミュレータPicturaを導入し、各エージェントの視点画像を用いた自己対戦学習で運転ポリシーを訓練。特権的な観測を使わずに、大規模な画像ベースの自己対戦学習を実現した。
- DiMaS: 分布マッチングによる視覚言語行動モデルの制御VLA2026/7/1
フローマッチング型の視覚言語行動モデル(VLA)に対して、内部表現の分布を移動させることで行動を細かく制御する手法DiMaSを提案した。従来の線形ステアリングがVLAでは効果が薄いことを示し、分布マッチングが有効であることを実証した。
- 自動運転のためのテスト時軌道最適化自動運転2026/6/1
自動運転のエンドツーエンドプランナーが生成した候補軌道を、学習済みのスコアラーを報酬関数としてテスト時に最適化する手法TOADを提案。再学習不要で既存プランナーに適用でき、複数のベンチマークで性能を向上させた。
- レジスタ上での運転:効率的なTransformerによるエンドツーエンド自動運転自動運転2026/1/1
事前学習済みViTにカメラ対応レジスタトークンを導入し、マルチカメラ特徴を圧縮して軽量なTransformerデコーダで軌道生成とスコアリングを行う、効率的なエンドツーエンド自動運転手法を提案した。
- RAP: 3Dラスタライゼーションで強化するエンドツーエンド計画自動運転/エンドツーエンド計画2025/10/1
フォトリアルな描画の代わりに注釈付きプリミティブの軽量ラスタライズで走行データを拡張し、特徴空間アライメントで実環境に転移する計画手法を提案。4つの主要ベンチマークで最高性能を達成。
- SmolVLA: 手頃で効率的なロボティクス向け視覚-言語-行動モデルVLA2025/6/1
大規模VLMを小型化し、単一GPUで学習・民生GPU/CPUで動作する効率的なVLAモデルを提案。非同期推論で応答性を高め、10倍規模のモデルに匹敵する性能を実現した。
- ビデオ生成モデリングによる自動運転:VaViMとVaVAM自動運転2025/2/1
大規模動画生成モデルを自動運転に応用し、自己回帰型動画モデルVaViMとそれを用いた運転軌道生成モデルVaVAMを提案。動画事前学習が実世界の運転に転移する可能性を示した。
- PPT: 擬似ラベル軌跡による事前学習で動き予測を強化動き予測2024/12/1
自動生成された多様な擬似ラベル軌跡を事前学習に活用し、少量のラベルデータでの微調整で動き予測性能を向上させるフレームワークPPTを提案。
- 運動予測のためのアニール付きWinner-Takes-All運動予測2024/9/1
自動運転の軌道予測において、Winner-Takes-All損失をアニール化することで初期化感度や学習不安定性を改善し、少数の仮説のみで高性能を達成する手法を提案した。
- ReGentS: 実世界の安全クリティカルな運転シナリオ生成を安定化自動運転シナリオ生成2024/9/1
実世界の複雑な運転シナリオを軌道最適化で修正し、安全クリティカルなシナリオを安定して生成する手法を提案。最大32エージェントに対応し、微分可能シミュレータで勾配降下を簡素化。
- Valeo4Cast: モジュール型アプローチによるエンドツーエンド予測予測2024/6/1
自動運転のためのエンドツーエンド軌道予測において、検出・追跡・予測を個別に学習してから微調整で統合するモジュール型手法を提案し、Argoverse 2チャレンジで首位を獲得した。
- Manipulating Trajectory Prediction with Backdoors2023/12/1
- Rewarded soups: towards Pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards2023/6/7
- Towards Motion Forecasting with Real-World Perception Inputs: Are End-to-End Approaches Competitive?2023/6/1
- LaRa: Latents and Rays for Multi-Camera Bird's-Eye-View Semantic Segmentation2022/6/1
- Raising context awareness in motion forecasting2021/9/1
- LiDARTouch: Monocular metric depth estimation with a few-beam LiDAR2021/9/1
- Explainability of deep vision-based autonomous driving systems: Review and challenges2021/1/1
- Driving Behavior Explanation with Multi-level Fusion2020/12/1