Xiaolong Li
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAマニピュレーションコンピュータビジョン
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- 剛性に基づく多指協調による力に敏感な物体の精密なハンド内操作マニピュレーション2026/2/1
触覚フィードバックなしで関節制御のみを用い、グラフ剛性と力閉包制約を組み合わせた二層フレームワークにより、壊れやすい物体を多指ハンドで精密かつ安全に操作する手法を提案。
- 第9回AIシティチャレンジコンピュータビジョン2025/8/1
交通・産業・公共安全分野におけるコンピュータビジョンとAIの実応用を推進する第9回AIシティチャレンジの概要。4つのトラックで245チームが参加し、3Dマルチカメラ追跡や交通安全のビデオQA、倉庫での空間推論、魚眼カメラの物体検出などが競われた。
- Towards Visual Foundational Models of Physical Scenes2023/6/1
- Natural grasp intention recognition based on gaze fixation in human-robot interaction2020/12/1
- Category-Level Articulated Object Pose Estimation2019/12/1