Avigyan Bhattacharya
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA意味論的マッピング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LLM-RG: 大規模言語モデルを用いた屋外シーンにおける参照表現のグラウンディングVLA2025/9/1
屋外運転シーンで自然言語の参照表現(例:「右側の黒い車」)が指す物体を特定するため、視覚言語モデルで属性を抽出し、大規模言語モデルで推論するハイブリッド手法を提案。Talk2Carベンチマークで大幅な精度向上を達成。
- RayFronts: オンラインシーン理解と探索のためのオープンセット意味論的レイフロンティア意味論的マッピング2025/4/1
距離内のボクセルと距離外のレイにオープンセット意味論を統合し、効率的な意味論的マッピングと探索を可能にする表現を提案。