Ningwei Ouyang
収録論文 4本 ・ フィジカルAI/ロボット学習
3D視覚グラウンディング/自動運転/マルチセンサVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Talk2Sensors: センサ適応型物理的手がかりマッチングによる自動運転の3D視覚グラウンディング3D視覚グラウンディング/自動運転/マルチセンサ2026/8/5
カメラ・LiDAR・4Dレーダーのマルチセンサデータを用いた自動運転向け3D視覚グラウンディングのデータセットと、言語クエリに応じてセンサ情報を動的に統合するTransformerベースのフレームワークを提案した。
- WaterVideoQA:マルチモーダルエージェントによるASV中心の知覚と規則準拠推論VLA2026/2/1
水上航行環境に特化した大規模動画QAベンチマークWaterVideoQAと、マルチエージェント神経記号システムNaviMindを提案し、ASVの認知・推論能力を評価・向上させる。
- Da Yu:水上監視とシーン理解のためのUSV向け画像キャプショニングVLA2025/6/1
水上環境の画像キャプションデータセットWaterCaptionを構築し、USV向けのエッジ展開可能なマルチモーダル大規模言語モデルDa Yuを提案した。
- Talk2Radar: 自然言語と4Dミリ波レーダーを結ぶ3D参照表現理解VLA2024/5/1
4Dミリ波レーダーの点群と自然言語を対応付ける初のデータセットTalk2Radarを構築し、3D参照表現理解のための新モデルT-RadarNetを提案した。