Doncey Albin
収録論文 6本 ・ フィジカルAI/ロボット学習
3Dビジュアルグラウンディングマルチロボット協調知覚マルチロボットVLA探索3D占有予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SceneGraphGrounder: 構造化シーングラフマッチングによるゼロショット3Dビジュアルグラウンディング3Dビジュアルグラウンディング2026/5/1
3Dシーングラフを構築し、クエリをグラフとして照合することで、ゼロショットで3D物体を言語指示により特定する手法を提案した。
- CU-Multi:マルチロボット協調知覚のためのデータセットマルチロボット協調知覚2025/9/1
複数ロボットの協調知覚研究用に、コロラド大学ボルダー校の屋外2地点で収集したRGB-D・RTK GPS・セマンティックLiDARを含む同期済みデータセットを構築した。
- CU-Multi: マルチロボットデータ関連付けのためのデータセットマルチロボット2025/5/1
複数ロボットの観測データを時空間で対応付ける研究用に、コロラド大学ボルダー校で収集したRGB-D・GPS・LiDARを含むマルチロボットデータセットを構築した。
- Spatial-LLaVA: 空間参照表現を用いた視覚理解のための大規模言語モデル強化VLA2025/5/1
SUN-Spot v2.0データセットを構築し、空間参照表現を学習させたマルチモーダルLLM「Spatial-LLaVA」を提案。ゼロショット空間推論ベンチマークで3.15%の性能向上を達成した。
- CogExplore: 言語で符号化された環境表現を用いた文脈的探索探索2024/6/1
大規模言語モデル(GPT-3.5やClaude Haiku)を活用し、意味情報や文脈手がかり、時間的状態を自然言語で推論することで、未探索環境におけるロボット探索の経路距離を大幅に短縮する手法を提案。
- SceneSense: 部分観測からの3D占有合成のための拡散モデル3D占有予測2024/3/1
単一のRGB-Dカメラと走行中の占有マップから、遮蔽・視野外の3D占有情報をリアルタイムに生成する拡散モデルを提案。観測済みの自由・占有空間を上書きしない設計で、ロボットの計画・制御に活用できる。