Xin Zhu
Xpeng Inc.
収録論文 3本 ・ フィジカルAI/ロボット学習
所属歴(論文より): Xpeng Inc.(〜2026) / Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(〜2026)
視覚基盤モデル手術ロボット操作マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- IronViT: 効率的な汎用視覚表現学習に向けて視覚基盤モデル2026/9/24
複数の専門家モデルの能力をソフトマックス注意で統合してからハイブリッド線形注意エンコーダへ蒸留し、高解像度でも効率的な汎用視覚エンコーダを実現した。
- S2-HWM: 長期手術ロボット操作のためのスパースイベント構造を持つ階層的世界モデル手術ロボット操作2026/8/1
手術ロボットの長期的な操作タスクにおいて、スパースなイベントを学習して階層的な世界モデルを構築し、イベントレベルのマネージャーとプリミティブステップのワーカーを協調させることで、報酬が疎な環境での成功率を大幅に向上させた。
- モンテカルロ木探索による先読み荷物を活用した効果的なオンライン3Dビンパッキングマニピュレーション2026/1/1
物流ロボットアームによるオンライン3Dビンパッキングにおいて、先読み情報を活用しMCTSと強化学習を組み合わせることで、分布シフト下でも高い性能を実現した研究。