Dian Chen
収録論文 17本 ・ フィジカルAI/ロボット学習
自動運転動的視点合成形状・姿勢推定マニピュレーション3D再構成/物体追跡
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 自己運転エージェントモデリングのための効率的等変トランスフォーマー自動運転2026/4/1
自己運転におけるエージェント行動モデリングを、SE(2)等変性を保ちつつ計算コストを削減する新しいトランスフォーマーアーキテクチャDriveGATrを提案した。
- AnyView: 動的シーンにおける任意の新規視点を合成動的視点合成2026/1/1
拡散モデルベースの動画生成フレームワークで、動的な実世界シーンにおいて任意のカメラ視点からの時空間的に一貫した新規動画を生成する。
- OmniShape: 実世界におけるゼロショット多仮説形状・姿勢推定形状・姿勢推定2025/8/1
単一観測から未知物体の姿勢と完全形状を推定するため、形状補完を2つのマルチモーダル分布に分離し、条件付き拡散モデルで複数仮説を生成する手法を提案。
- マルチタスク巧みな操作のための大規模行動モデルの慎重な検証マニピュレーション2025/7/1
大規模行動モデル(LBM)をシミュレーションと実世界で厳密に評価し、マルチタスク事前学習が単一タスクより成功率・堅牢性・データ効率を高めることを統計的に示した。
- GTR: 外観と幾何学的複雑さに基づく未知物体のガウシアンスプラッティング追跡と再構成3D再構成/物体追跡2025/5/1
単眼RGBD動画から未知物体の6自由度追跡と高品質な3D再構成を同時に行う手法を提案。3Dガウシアンスプラッティングと外観・形状のハイブリッド追跡、キーフレーム選択を組み合わせ、対称性や複雑な形状・外観を持つ物体でも頑健に動作する。
- 非対称セルフプレイによる運転方策の学習自動運転2024/9/1
教師が生徒には解けないが自分は解けるシナリオを生成し、生徒がそれを解くという非対称セルフプレイで、長尾シナリオを含む現実的な運転方策を学習する手法を提案。
- FSD: Fast Self-Supervised Single RGB-D to Categorical 3D Objects2023/10/1
- MotionLM: Multi-Agent Motion Forecasting as Language Modeling2023/9/1
- Viewpoint Equivariance for Multi-View 3D Object Detection2023/3/1
- Standing Between Past and Future: Spatio-Temporal Modeling for Multi-Camera 3D Multi-Object Tracking2023/2/1
- COOPERNAUT: End-to-End Driving with Cooperative Perception for Networked Vehicles2022/5/1
- Learning from All Vehicles2022/3/1
- Learning to drive from a world on rails2021/5/1
- Learning by Cheating2019/12/1
- Learning Instance Segmentation by Interaction2018/6/1
- Zero-Shot Visual Imitation2018/4/1
- Combining Self-Supervised Learning and Imitation for Vision-Based Rope Manipulation2017/3/1