Zhi-Xin Yang
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA/ナビゲーション自動運転ナビゲーション3D再構成回転推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SpaAct: 空間活性化遷移学習とカリキュラム適応による視覚言語ナビゲーションVLA/ナビゲーション2026/4/30
視覚言語ナビゲーション(VLN)のためのVLM適応フレームワークSpaActを提案。後方行動推論と前方遷移予測の2つの空間活性化タスクと、TriPAカリキュラム学習により動的空間認識を獲得し、VLN-CEベンチマークでSOTAを達成。
- DVGT-2: 大規模自動運転のためのビジョン・ジオメトリ・アクションモデル自動運転2026/4/1
自動運転のための新しいVGAパラダイムを提案し、オンライン推論可能なストリーミング型のDVGT-2を導入。密な3Dジオメトリと軌道計画を同時に出力し、多様なカメラ設定で微調整なしに適用可能。
- 考える前に進む:画像目標ナビゲーションのための階層的推論ナビゲーション2026/4/1
画像目標ナビゲーションを高レベル計画と低レベル実行に分解し、視覚言語モデルで短期的計画を生成して強化学習ポリシーを導く階層的フレームワークHRNavを提案。迷いを減らすペナルティも導入し、シミュレーションと実環境で有効性を実証した。
- 運転視覚幾何Transformer3D再構成2025/12/1
自動運転向けに、カメラパラメータ不要で多視点画像列からメートルスケールの密な3D点群と自車姿勢を推定するTransformerモデルを提案。
- 線形解法によるロバストな回転推定回転推定2025/6/1
回転推定を線形モデルフィッティングとして再定式化し、クォータニオン球面上の大円表現に基づく投票法を提案。GPU並列化により大規模・高外れ値比でも高速かつ高精度に推定できる。
- ステレオ投影による外れ値に頑健な回転推定の高速化回転推定2025/2/1
ステレオ投影と空間投票を用いて、多数の外れ値を含む大規模入力から回転を高速かつ高精度に推定する手法を提案し、GPUを用いて100万点・90%外れ値の問題を0.07秒で解けることを示した。
- Efficient Jacobian-Based Inverse Kinematics with Sim-to-Real Transfer of Soft Robots by Learning2020/12/1