Tianyi Yan
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Qwen-RobotWorld 技術報告:言語条件付きビデオ生成による身体化世界モデルの統合世界モデル/ビデオ生成2026/6/15
自然言語を統一アクションインターフェースとして用い、現在の観測から物理的に妥当な未来の視覚軌跡を予測する言語条件付きビデオ世界モデルを提案。ロボット操作、自動運転、屋内ナビゲーション、人間からロボットへの転移を統一的に扱い、データ生成・評価環境・計画信号の3つの応用を示す。
- あなたの運転ワールドモデルは万能選手か?自動運転/評価ベンチマーク2026/5/1
運転ワールドモデルの性能を画質から閉ループ運転まで多面的に評価する統一ベンチマークWorldLensを提案し、既存モデルが全軸で優れないことを示した。
- UniDriveVLA:自動運転のための理解・知覚・行動計画の統合自動運転/VLA2026/4/1
自動運転向けのVLAモデルにおいて、空間知覚と意味推論の競合を解消するため、Mixture-of-Transformersによる専門家分離を導入した統合モデルUniDriveVLAを提案し、nuScenesとBench2Driveで最先端性能を達成した。
- 人間の意図から行動予測へ:意図駆動型エンドツーエンド自動運転自動運転2025/12/1
自然言語による高レベルな人間の意図を解釈して運転行動を生成する「意図駆動型エンドツーエンド自動運転」を定義し、大規模データセットと生成的ワールドモデルによる新評価指標IFAを備えたベンチマークIntention-Driveを構築した。
- 3D・4D世界モデリングのサーベイ世界モデル2025/9/1
RGB-D画像や占有グリッド、LiDAR点群といったネイティブな3D/4D表現を用いた世界モデリング研究を初めて体系的に整理し、定義・分類・データセット・評価指標をまとめたサーベイ。
- RoboPearls: ロボットマニピュレーションのための編集可能なビデオシミュレーションsim2real2025/6/1
3Dガウススプラッティングを用いて実演ビデオからフォトリアルなシミュレーションを構築し、LLMで自動化された編集操作を可能にするロボットマニピュレーション向けフレームワークを提案。
- OLiDM: 自動運転のための物体認識型LiDAR拡散モデルLiDAR生成2024/12/1
物体レベルとシーンレベルの両方で高品質なLiDAR点群を生成する拡散モデルを提案し、前景物体の制御性と背景との整合性を向上させた。
- DrivingSphere: 閉ループシミュレーションのための高忠実度4D世界構築自動運転シミュレーション2024/11/1
4D占有表現で動的な運転環境を構築し、高忠実度の多視点映像を生成する閉ループ自動運転シミュレーションフレームワークを提案。