Luqiao Wang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA/検証強化学習基盤技術
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Pre-VLA: 信頼性の高い視覚言語行動・ワールドモデル展開のための先制ランタイム検証VLA/検証2026/5/1
VLAモデルや生成ワールドモデルの行動生成の不確実性に対処するため、物理実行や想像の前に行動の妥当性を検証する統一ランタイム検証アーキテクチャを提案した。
- D-VLA: 視覚言語行動モデルのための高並列分散非同期強化学習フレームワーク強化学習2026/5/1
大規模VLAモデルへの強化学習適用時のリソース競合を解決するため、物理分離と非同期パイプラインを備えた分散RLフレームワークD-VLAを提案し、スループットとサンプリング効率を大幅に向上させた。
- AIネイティブクラウド具身知能基盤のための千GPU大規模訓練と最適化レシピ基盤技術2026/3/1
具身知能の大規模訓練を実現するため、クラウド上に千GPU分散訓練プラットフォームを構築し、データパイプラインやモデル最適化、インフラ連携により訓練時間を40倍短縮した。