Hengyuan Zhang
収録論文 9本 ・ フィジカルAI/ロボット学習
全身復元自動運転/駐車自動運転/トポロジー推論VLAオンラインマッピング世界モデル自動運転/オンラインマッピング自動運転/ベクトルマップ生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DanceHMR: 単眼ビデオからの手を含む全身人体メッシュ復元全身復元2026/5/18
単眼ビデオから全身の動きと手の詳細を安定して復元する新しいフレームワークを提案。
- Dino-Diffusionモジュラー設計による自動駐車のクロスドメインギャップの橋渡し自動運転/駐車2025/10/1
視覚基盤モデルと拡散ベースの計画を組み合わせ、天候や照明の変化などドメインシフト下でも90%以上の成功率で駐車できる自動駐車パイプラインを提案した。
- SMART: 運転トポロジー推論のためのスケーラブルな地図事前分布の進展自動運転/トポロジー推論2025/2/1
SD地図と衛星画像から地図事前分布モデルを学習し、センサー構成に依存せずスケーラブルな車線トポロジー推論を実現する手法を提案。OpenLane-V2で最大28%の改善。
- RoboBrain:抽象的から具体的へと至るロボット操作のための統合脳モデルVLA2025/2/1
ロボット操作に必要な計画・アフォーダンス知覚・軌道予測を統合したMLLMベースの脳モデルRoboBrainを提案し、多次元情報を付与した大規模データセットShareRobotで訓練して最先端性能を達成した。
- MapGS: 新規視点合成によるオンラインマッピングの汎用事前学習とデータ拡張オンラインマッピング2025/1/1
Gaussian Splattingでシーンを再構成し、異なるセンサ構成のカメラ画像を合成してオンラインマッピングモデルを学習させることで、センサ構成の違いへの汎化性能を向上させた研究。
- EVA: 未来映像予測のための身体性世界モデル世界モデル2024/10/1
視覚言語モデルと映像生成モデルを組み合わせ、身体性シナリオでの多段階未来予測を可能にする世界モデルEVAとその評価ベンチマークEVA-Benchを提案した。
- 標準地図を活用したオンライン道路網認識・推論の強化自動運転/オンラインマッピング2024/8/1
軽量な標準地図(SDマップ)を事前情報としてオンラインHDマップ生成に組み込み、収束の高速化とセンタライン認識性能の30%向上を実現した研究。
- SemVecNet: 任意のセンサ構成に汎化可能なベクトルマップ生成自動運転/ベクトルマップ生成2024/5/1
確率的セマンティックマッピングでBEVセマンティックマップを中間表現として生成し、MapTRv2デコーダでベクトルマップに変換することで、未知のセンサ構成にも汎化するベクトルマップ生成パイプラインを提案した。
- TridentNet: A Conditional Generative Model for Dynamic Trajectory Generation2021/1/1