Francesco Nex
収録論文 6本 ・ フィジカルAI/ロボット学習
SLAM/シーングラフ3次元再構成自動運転マルチタスク知覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Mono-Hydra++: マルチタスク学習によるリアルタイム単眼シーングラフ構築と3D屋内マッピングSLAM/シーングラフ2026/5/1
単眼RGBとIMUのみを用いて、屋内のメトリックセマンティックマッピングと階層的3Dシーングラフをリアルタイムに構築するパイプラインを提案した。
- ZeD-MAP:バンドル調整によるゼロショット深度マップのリアルタイム航空撮影への応用3次元再構成2026/4/1
UAV画像からリアルタイムに高精度な深度を復元するため、拡散モデルによる深度推定にバンドル調整を組み合わせ、メートル単位の一貫性を実現するフレームワークを提案した。
- DriveVA: ビデオ行動モデルはゼロショット運転者である自動運転2026/4/1
自動運転のための世界モデルDriveVAを提案し、将来の映像と行動系列を共有の生成過程で同時に予測することで、ゼロショットでの汎化性能を向上させた。
- M2H: 単眼空間知覚のための効率的なウィンドウベースクロスタスク注意を用いたマルチタスク学習マルチタスク知覚2025/10/1
単眼画像からセマンティックセグメンテーション・深度・エッジ・表面法線を同時推定する軽量マルチタスク学習フレームワークM2Hを提案し、ウィンドウベースのクロスタスク注意でタスク間の特徴交換を効率化した。
- Channel-Aware Distillation Transformer for Depth Estimation on Nano Drones2023/3/1
- Real-time Semantic Segmentation with Context Aggregation Network2020/11/1