Xi Yang
University of Electronic Science and Technology of China
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーション誤情報検出マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OccPlanner: 目標認識占有条件付き拡散プランナーによるピクセルゴールナビゲーションナビゲーション2026/8/14
カメラ画像のピクセルで指定された目標へのナビゲーションを、3D占有情報を条件とした拡散モデルで実現。モノクロ動画から3D占有アノテーションを生成する手法も提案し、シミュレーションと実機で高い成功率を達成した。
- 見ることが信じることではない ― 検索基盤型動画誤情報検出のベンチマーク誤情報検出2026/6/2
動画の誤情報を検出するため、ウェブ検索で関連動画を探し比較するベンチマークEVID-Benchを構築し、最先端モデルの性能が低いことを示した。
- ATOM-Bench: 操作ポリシーにおける原子スキルと構成的一般化のための実世界ベンチマークマニピュレーション2026/6/1
実世界の操作ポリシーを評価するためのベンチマークATOM-Benchを提案し、原子スキルと構成的一般化を分離して評価する。
- RoboBrain 2.5:奥行きを見据え、時間を心に刻むVLA2026/1/1
深度認識に基づく3D空間推論と、時間的な進捗予測を統合した次世代の身体性AI基盤モデルを提案し、複雑なマニピュレーションの精度と実行認識を向上させた。
- RoboCOIN: 統合マニピュレーションのためのオープンソース両腕ロボットデータ収集マニピュレーション2025/11/1
15種類のロボットプラットフォームから18万件以上の両腕操作デモを集めた大規模データセットを構築し、階層的な注釈とデータ処理パイプラインを提供した。
- RoboBrain 2.0 技術報告VLA2025/7/1
視覚と言語を統合し、実環境での知覚・推論・計画を担う具現化基盤モデルRoboBrain 2.0を提案。7Bと32Bの2種類で、空間理解や時系列意思決定タスクで高い性能を示す。