Jian Yao
Xpeng Inc.
収録論文 3本 ・ フィジカルAI/ロボット学習
視覚基盤モデル模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- IronViT: 効率的な汎用視覚表現学習に向けて視覚基盤モデル2026/9/24
複数の専門家モデルの能力をソフトマックス注意で統合してからハイブリッド線形注意エンコーダへ蒸留し、高解像度でも効率的な汎用視覚エンコーダを実現した。
- HRT1: 人間からロボットへのワンショット軌道転送による移動マニピュレーション模倣学習2025/10/1
ARヘッドセットで撮影した人間のデモ動画から手の3D軌道を抽出し、移動マニピュレータのエンドエフェクタ軌道へ転送して、環境や物体配置が異なっても同じ作業を一度の実演で再現できるシステムを提案した。
- Active Pose Refinement for Textureless Shiny Objects using the Structured Light Camera2023/8/1