Yue Huang
GENISOM AI
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA世界モデル/計画データセット4D時空間推論自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MobileVLA-R1 2.0: モバイルロボット制御のための強化学習強化推論VLA2026/9/5
モバイルロボットのVLAシステムにおいて、言語指示を実行可能な行動に変換する課題に対し、構造化された推論と強化学習を組み合わせたフレームワークを提案し、ナビゲーションや操作タスクで評価した。
- 物理的に基盤づけられたJEPA世界モデルによる目標条件付きロボット計画世界モデル/計画2026/9/3
ロボット制御に有用な表現を学習するため、逆動力学と状態整合を組み込んだJEPA世界モデルを提案し、複数のベンチマークで高い計画成功率を達成した。
- ACE-Data-0: 人間中心の環境キャプチャによる具現化データエンジンデータセット2026/7/30
家庭環境を校正済みの録音スタジオに変えるデータ収集エンジンACEを提案し、多感覚データセットACE-Data-0を構築した。
- DynTrace: 4D時空間推論のための動的物体証跡追跡4D時空間推論2026/7/14
MLLMの4D時空間推論を強化するため、トレーニング不要のフレームワークDynTraceを提案。動的軌跡可視化と動的トレーストークンで物体の動きを連続追跡し、カメラ運動と物体運動を分離する。
- RoboStream: 視覚言語モデルに時空間推論と記憶を統合したロボット操作フレームワークVLA2026/3/1
視覚言語モデルに時空間融合トークンと因果時空間グラフを導入し、長期ロボット操作における幾何学的定位と行動による状態変化の記憶を訓練なしで実現する。
- 自動運転のための生成AI:フロンティアと機会自動運転2025/5/1
生成AI(VAE・GAN・拡散モデル・LLM)を自動運転スタック全体にどう応用するかを体系的に整理したサーベイ。データ生成からEnd-to-End運転、デジタルツイン、評価・安全・規制まで課題と研究方向をまとめる。