Kaixiang Huang
収録論文 3本 ・ フィジカルAI/ロボット学習
VQA/空間認識点群生成/拡散モデルマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GST-Bench: ビデオからVLMsはグローバルな空間認識を獲得できるか?VQA/空間認識2026/8/6
連続的な長期間ビデオからグローバルな空間認識を評価する新しいベンチマークGST-Benchを提案し、22の最先端VLMを評価した結果、人間との大きなギャップを明らかにした。
- レンジ画像で駆動する拡散モデルによるミリ波レーダー点群の高密度化点群生成/拡散モデル2025/3/1
ミリ波レーダーの点群をレンジ画像に変換し、事前学習済み画像拡散モデルを活用してLiDAR並みの高密度で正確な3D点群を生成する手法を提案した。
- VLMとKMPを橋渡し:意味的キーポイント表現による細やかなロボットマニピュレーションマニピュレーション2025/3/1
VLMの意思決定能力とKMPの精密な軌道生成を意味的キーポイントで連携させ、曖昧な状況下でも細やかなマニピュレーションを実現するVL-MPを提案した。