Shu-Tao Xia
収録論文 2本 ・ フィジカルAI/ロボット学習
世界モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LAWM-3D: 人間のビデオから3D認識潜在アクションを学習し、汎用ロボット世界モデルを実現世界モデル2026/8/6
人間のビデオから自己教師ありで3D認識可能な潜在アクションを学習し、ロボットの世界モデルを構築する手法を提案。マルチビュー入力の課題を解決するため、幾何学的整合性とRGB-D再構成を導入。
- ElegantVLA: 効率的な視覚言語行動モデルのための思考タイミング学習VLA2026/5/1
VLAモデルの計算コストを削減するため、制御ステップごとに計算量を動的に調整するプラグイン型の位相適応推論フレームワークを提案。