Xiaolong Xiang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA強化学習基盤技術
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- JoyNexus: VLAモデルのためのサービス指向マルチテナント後訓練VLA2026/7/17
VLAモデルの後訓練を効率化するため、マルチテナント対応の統合サービスを提案。訓練・推論・環境サービスを分離し、APIで提供することで、リソース利用の効率化とコスト削減を実現。
- D-VLA: 視覚言語行動モデルのための高並列分散非同期強化学習フレームワーク強化学習2026/5/1
大規模VLAモデルへの強化学習適用時のリソース競合を解決するため、物理分離と非同期パイプラインを備えた分散RLフレームワークD-VLAを提案し、スループットとサンプリング効率を大幅に向上させた。
- AIネイティブクラウド具身知能基盤のための千GPU大規模訓練と最適化レシピ基盤技術2026/3/1
具身知能の大規模訓練を実現するため、クラウド上に千GPU分散訓練プラットフォームを構築し、データパイプラインやモデル最適化、インフラ連携により訓練時間を40倍短縮した。