Xuantang Xiong
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAモデルベースRL
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RxBrain:言語と視覚の推論・想像を統合した身体化認知基盤モデルVLA2026/7/1
身体化認知のための基盤モデルRxBrainを提案。言語による計画構造と視覚による世界状態予測を統合し、単一の計画シーケンスで表現する。
- ProAct: 構造認識型能動応答のためのベンチマークとマルチモーダルフレームワークVLA2026/2/1
75タスク・91,581アノテーションからなる能動エージェント用ベンチマークProAct-75を構築し、タスクグラフとMLLMを活用したベースラインProAct-Helperを提案した。
- MrCoM: マルチシナリオに汎化するメタ正則化ワールドモデルモデルベースRL2025/11/9
同一シミュレータ内の力学特性の共通性を利用し、潜在状態を動的特性ごとに分解してメタ状態・メタ価値正則化を施すことで、複数シナリオに汎化する統一ワールドモデルを構築した。