Junjie Zhu
収録論文 3本 ・ フィジカルAI/ロボット学習
VQA/空間認識触覚/操作マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GST-Bench: ビデオからVLMsはグローバルな空間認識を獲得できるか?VQA/空間認識2026/8/6
連続的な長期間ビデオからグローバルな空間認識を評価する新しいベンチマークGST-Benchを提案し、22の最先端VLMを評価した結果、人間との大きなギャップを明らかにした。
- 触覚対応ワールドアクションモデル:非対称注意による触覚統合触覚/操作2026/6/1
接触を伴う操作タスクで、視覚と触覚を統合した世界行動モデルを提案。触覚トークンが視覚ダイナミクスを乱す問題を非対称注意機構で解決し、実ロボットで成功率を向上させた。
- VLMとKMPを橋渡し:意味的キーポイント表現による細やかなロボットマニピュレーションマニピュレーション2025/3/1
VLMの意思決定能力とKMPの精密な軌道生成を意味的キーポイントで連携させ、曖昧な状況下でも細やかなマニピュレーションを実現するVL-MPを提案した。