Xinyu Huang
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MIVIFI:多視点魚眼画像生成モデルの訓練のための視点と魚眼ドメインの橋渡し画像生成2026/8/24
自動運転のための多視点魚眼画像生成を、等距離円筒投影を用いたクロスドメイン学習で実現し、データ不足を克服した。
- 身体化LLMのアクションレベル操作による脱獄攻撃セキュリティ2026/3/1
身体化LLMのセキュリティ脆弱性を突き、意味的に安全に見える指示で危険な物理的結果を引き起こす自動攻撃フレームワーク「Blindfold」を提案した。
- 制約付き駐車シーンにおける経路計画への強化学習の適用経路計画2026/1/1
狭い駐車場での切り返しが多い経路計画を、自転車モデルに基づく深層強化学習でリアルタイムに解く手法を提案し、新ベンチマークで従来手法を上回る成功率と効率を達成した。
- LLM制御ロボティクスにおける信頼性:セキュリティ脅威、防御策、課題のサーベイVLA2026/1/1
LLMで制御されるロボットのセキュリティ脅威と防御策を体系的に整理し、攻撃手法・防御機構・評価ベンチマークを分類したサーベイ。
- ExpertAD: Mixture of Expertsによる自動運転システムの強化自動運転2025/11/1
複雑な運転シーンでの知覚と計画の課題に対処するため、Mixture of Expertsアーキテクチャを採用したExpertADを提案し、衝突率と推論遅延を削減した。
- Dino-Diffusionモジュラー設計による自動駐車のクロスドメインギャップの橋渡し自動運転/駐車2025/10/1
視覚基盤モデルと拡散ベースの計画を組み合わせ、天候や照明の変化などドメインシフト下でも90%以上の成功率で駐車できる自動駐車パイプラインを提案した。
- オンライン言語スプラッティングVLA2025/3/1
3DガウシアンスプラッティングSLAMにおいて、事前生成なしでオンラインかつほぼリアルタイムに言語特徴を統合し、高精度なオープンボキャブラリ3Dマッピングを実現するフレームワークを提案。
- SMART: 運転トポロジー推論のためのスケーラブルな地図事前分布の進展自動運転/トポロジー推論2025/2/1
SD地図と衛星画像から地図事前分布モデルを学習し、センサー構成に依存せずスケーラブルな車線トポロジー推論を実現する手法を提案。OpenLane-V2で最大28%の改善。
- Depth Any Camera: あらゆるカメラからのゼロショットメトリック深度推定深度推定2025/1/1
透視画像のみで学習したモデルをERP表現とFoV整合により拡張し、魚眼や360度カメラでも高精度にメトリック深度を推定するフレームワークを提案。
- MapGS: 新規視点合成によるオンラインマッピングの汎用事前学習とデータ拡張オンラインマッピング2025/1/1
Gaussian Splattingでシーンを再構成し、異なるセンサ構成のカメラ画像を合成してオンラインマッピングモデルを学習させることで、センサ構成の違いへの汎化性能を向上させた研究。
- 標準地図を活用したオンライン道路網認識・推論の強化自動運転/オンラインマッピング2024/8/1
軽量な標準地図(SDマップ)を事前情報としてオンラインHDマップ生成に組み込み、収束の高速化とセンタライン認識性能の30%向上を実現した研究。
- Symmetry and Uncertainty-Aware Object SLAM for 6DoF Object Pose Estimation2022/5/1