Jeremy Smith
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NanoMVG: プロンプト誘導カメラと4Dミリ波レーダーによるUSV中心の低消費電力マルチタスク視覚グラウンディングVLA2024/8/1
水上自律走行体(USV)向けに、カメラと4Dミリ波レーダーを自然言語で誘導し、物体の位置を特定する低消費電力マルチタスク視覚グラウンディングモデルNanoMVGを提案。WaterVGデータセットで競争力のある性能を示し、厳しい環境でも長時間運用可能。
- Talk2Radar: 自然言語と4Dミリ波レーダーを結ぶ3D参照表現理解VLA2024/5/1
4Dミリ波レーダーの点群と自然言語を対応付ける初のデータセットTalk2Radarを構築し、3D参照表現理解のための新モデルT-RadarNetを提案した。
- WaterVG: テキスト誘導型視覚とミリ波レーダーによる水路の視覚的グラウンディングVLA2024/3/1
USVの水路知覚向けに、テキストプロンプトで視覚とミリ波レーダーを統合した初の視覚的グラウンディングデータセットWaterVGと、低消費電力モデルPotamoiを提案した。
- Achelous++: Power-Oriented Water-Surface Panoptic Perception Framework on Edge Devices based on Vision-Radar Fusion and Pruning of Heterogeneous Modalities2023/12/1
- ASY-VRNet: Waterway Panoptic Driving Perception Model based on Asymmetric Fair Fusion of Vision and 4D mmWave Radar2023/8/1
- Achelous: A Fast Unified Water-surface Panoptic Perception Framework based on Fusion of Monocular Camera and 4D mmWave Radar2023/7/1