Yash Bhalgat
収録論文 3本 ・ フィジカルAI/ロボット学習
3D視覚言語理解3D-LLMNeRF/3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 3D大規模言語モデルは本当に3D空間関係を理解しているのか?3D視覚言語理解2026/3/1
既存の3D-LLMがテキストの手がかりに頼っており、3D空間理解を正しく評価できていない問題を指摘し、より厳密なベンチマークReal-3DQAと3D視覚情報を活用する学習手法を提案した。
- LLMが3D世界へ:マルチモーダル大規模言語モデルによる3Dタスクのサーベイとメタ分析3D-LLM2024/5/1
LLMを3D空間データに統合する3D-LLMの研究を、点群からNeRFまでの表現、シーン理解・対話・ナビゲーションなどのタスク、課題と将来展望まで体系的に整理したサーベイ。
- SiLVR: ロボット検査のためのスケーラブルなLiDAR-視覚再構成とニューラル放射輝度場NeRF/3D再構成2024/3/1
LiDARとカメラ画像を融合し、NeRFを用いて大規模環境を幾何学的に正確かつ写実的に再構成するシステムを提案。脚ロボットやドローンでの実証実験を行った。