Jianming Xing
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA空間推論視覚ポインティング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- エルミート曲線による視覚言語行動モデルの軌道事前分布VLA2026/8/1
VLAモデルのアクションチャンクをエルミート曲線でパラメータ化し、滑らかさと連続性を明示的に強制する3つの変種を提案。正則化として用いるのが最も効果的で、実ロボットタスクで成功率を大幅に向上させた。
- RoboSpatialチャレンジ技術報告:選択的推論活性化と参照フレーム曖昧性解消による身体化空間推論空間推論2026/6/30
CVPR 2026のRoboSpatialチャレンジで1位を獲得した、ロボットの空間推論を強化する推論時プロンプト手法を提案した論文。
- 具現化AIのための効率的視覚ポインティング:エージェント駆動データ合成、クロスブロック注意、反復補正視覚ポインティング2026/6/29
言語指示からピクセル座標を推定する視覚ポインティングの精度向上を目指し、データ合成とモデル改良を組み合わせてPointArena 2026で77.2%の精度を達成した。