Xiaoyu Tian
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DAVIS: ヒューマノイドサッカースキルのための深度のみのエンドツーエンド能動視覚フレームワークVLA2026/9/23
頭部搭載の深度画像と固有感覚履歴のみから、ヒューマノイドロボットがサッカーのシュートやドリブルを直接25自由度の関節PD目標として学習するエンドツーエンドフレームワークを提案。
- SkillX: ヒューマノイドサッカーのための統合マルチスキルポリシー学習歩行/強化学習2026/9/6
ヒューマノイドサッカーにおいて、単一のコマンド条件付きポリシーでドリブル、トラップ、シュートなどの複数のスキルを学習・切り替え可能にする統一強化学習フレームワークを提案した。
- GigaBrain-0.7:三系統アーキテクチャによる創発的能力へのスケーリングVLA2026/8/16
視覚言語行動モデルのスケーリングとアーキテクチャ改善により、多様なロボットへの汎化を大幅に向上させた基盤モデルを提案。
- 微分可能なクアッドローター動力学を用いた俊敏な侵入者迎撃の学習制御2026/7/1
受動的な単眼カメラセンサーで得られる3次元方向ベクトルと状態のみを用いて、侵入者を迎撃する制御ポリシーを微分可能な動力学モデルで学習する手法を提案。
- GigaWorld-Policy-0.5: AutoResearchによる高速・高精度なWAMの実現VLA2026/7/1
将来の視覚予測を訓練時のみに用い、推論時は行動生成のみで高速化した行動中心のWorld Action Modelを提案し、AutoResearchで最適設定を探索して性能を向上させた。
- GigaWorld-1: ロボットポリシー評価のためのワールドモデル構築ロードマップワールドモデル2026/7/1
ロボットポリシーの評価を効率化するため、ワールドモデルの信頼性を体系的に研究し、ベンチマークWMBenchを構築して、7つのビデオワールドモデルと4つの行動表現を比較した。
- UniDex: 人間の一人称視点ビデオからの汎用器用ハンド制御のためのロボット基盤スイート器用操作2026/3/1
人間の一人称視点ビデオからロボット実行可能な軌道を生成し、統一された行動空間と3D VLAポリシーを用いて、複数の器用ハンドへの汎用制御を実現する基盤スイートを提案した。
- 単眼視覚慣性リスケーリングによるゼロショットメートル深度推定:自律飛行ナビゲーションへの応用深度推定2025/9/1
単眼RGB画像とIMUからメートル深度を予測する手法を提案し、視覚慣性ナビゲーションで得た疎な3D特徴マップを用いて相対深度をゼロショットで再スケーリングする。計算制約のあるドローン上で15Hzのオンボード深度推定を実現し、衝突回避に成功した。
- VectorFlow: Combining Images and Vectors for Traffic Occupancy and Flow Prediction2022/8/1
- Unsupervised Learning of 3D Scene Flow from Monocular Camera2022/6/1