Xinyang Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAVLA/ロボット基盤モデル自動運転/VLASLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 具身知能のためのMixture-of-Expertsビデオ事前学習のスケーリングVLA2026/7/8
ロボット制御に特化したビデオ生成モデルLingBot-Videoを提案。MoEアーキテクチャとロボット向けデータ、物理合理性を評価する報酬系で、デジタル生成と物理動作の橋渡しを目指す。
- 基盤から応用へ:実践におけるVLAモデルの改善VLA/ロボット基盤モデル2026/7/1
VLA基盤モデルの実用化ギャップを埋めるため、データパイプライン刷新、行動空間拡張、予測ダイナミクスモデリングの3点を改良したLingBot-VLA 2.0を提案し、ベンチマークで効果を実証した。
- 汎用ロボット制御のためのネイティブなビデオ・アクション事前学習VLA2026/7/1
ロボット制御に特化したビデオ・アクション基盤モデルLingBot-VA 2.0を提案。意味的視覚・行動トークナイザ、因果事前学習、スパースMoE、非同期推論により、複雑な操作タスクでの数ショット汎化を実現した。
- 自動運転のための言語-行動の理解と生成の統合自動運転/VLA2026/3/1
自動運転向けのVLAモデルにおいて、言語と行動のトークンを共有コードブックで統合し、補助的な行動理解目標と粗密生成法を導入することで、指示追従精度と推論効率を向上させた。
- 一貫性を改善したLiDAR慣性バンドル調整SLAM2026/2/1
平面・エッジ特徴をステレオ投影で表現し、FEJ付きMAP推定でLiDAR慣性BAの一貫性を高め、オドメトリに適用した研究。
- 決定論的ワールドモデルによる視覚ベースEnd-to-End制御の閉ループ到達可能性解析VLA2025/12/8
物理状態から合成カメラ画像を生成する決定論的ワールドモデルを提案し、確率的潜在変数による過大近似なしに視覚ベース制御器の閉ループ到達可能性解析を可能にした。