Xinghui Li
収録論文 4本 ・ フィジカルAI/ロボット学習
ナビゲーションVSLAM3D再構成/NeRF/SDF3D-LLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボストラル・ナビゲート:単眼RGBのみで動作するスケーラブルな視覚言語ナビゲーションモデルナビゲーション2026/7/1
単眼RGB画像のみを入力とし、画像空間上でウェイポイントを予測することで、様々なロボット形態に再較正なしで適用可能な8B視覚言語モデルを提案。大規模シミュレーションデータと効率的な学習手法により、実世界データへの依存を低減しつつ高性能を実現した。
- 近赤外光を用いた視覚的同時自己位置推定・地図構築技術の研究VSLAM2025/3/1
環境光の影響を受けにくい近赤外光を光源に用い、光度パラメータ推定や露光時間補正によりDirect Sparse Odometryの位置推定精度を向上させるNIR-VSLAMを提案した。
- UW-SDF: 水中多視点単眼画像からのニューラルSDF再構成のためのハイブリッド幾何事前分布の活用3D再構成/NeRF/SDF2024/10/1
水中の多視点画像からニューラルSDFを用いて物体を3D再構成するフレームワークを提案し、ハイブリッド幾何事前分布とSAMを活用した少数ショット多視点セグメンテーションで高精度・高効率を実現した。
- LLMが3D世界へ:マルチモーダル大規模言語モデルによる3Dタスクのサーベイとメタ分析3D-LLM2024/5/1
LLMを3D空間データに統合する3D-LLMの研究を、点群からNeRFまでの表現、シーン理解・対話・ナビゲーションなどのタスク、課題と将来展望まで体系的に整理したサーベイ。