Yonghong Tian
収録論文 8本 ・ フィジカルAI/ロボット学習
エージェント/経験進化視覚言語ナビゲーションベンチマーク世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LabEvolver: 訓練不要の経験進化による安全で接地されたウェットラボエージェントエージェント/経験進化2026/7/1
実行経験からエピソード記憶を獲得し、安全検証を伴う適応的知覚・計画を行う訓練不要のフレームワークを提案。pH調整タスクで時間と安全介入を大幅削減し、ALFWorldでも成功率を向上させた。
- FSD-VLN: 空中長距離視覚言語ナビゲーションのための高速・低速デュアルシステムモデリング視覚言語ナビゲーション2026/7/1
UAVの長距離ナビゲーション向けに、意味推論と低遅延飛行制御を分離した高速・低速デュアルシステムアーキテクチャを提案し、未見シーンでの成功率を2倍に向上させつつ推論遅延を50%以上削減した。
- WorldArena 2.0:モダリティ・機能・プラットフォームにわたる身体化ワールドモデルベンチマークの拡張ベンチマーク2026/5/1
身体化ワールドモデルの評価を、視覚のみから視触覚へ、政策評価から強化学習環境としての利用へ、シミュレータから実ロボットへと拡張したベンチマークを提案した。
- WorldArena:身体性世界モデルの知覚と機能的実用性を評価する統合ベンチマーク世界モデル2026/2/1
身体性世界モデルを映像知覚品質と下流タスクでの機能的実用性の両面から評価する統合ベンチマークWorldArenaを提案し、14モデルの実験から知覚と機能の間に大きなギャップがあることを示した。
- デルタトライプレーン・トランスフォーマー:占有世界モデル世界モデル2025/3/1
自動運転向けに、3D占有の変化をトライプレーン表現で効率的に予測する新しい世界モデルを提案し、従来比1.44倍の高速化と精度向上を実現した。
- SODFormer: Streaming Object Detection with Transformer Using Events and Frames2023/8/1
- Learning Local Feature Descriptor with Motion Attribute for Vision-based Localization2019/8/1
- 2D LiDAR Map Prediction via Estimating Motion Flow with GRU2019/2/1