Jinghan Cao
収録論文 2本 ・ フィジカルAI/ロボット学習
マルチモーダル検証VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UNMATCH: 画像と主張の対応検証のための選択的不均衡トークン・パッチマッチングマルチモーダル検証2026/9/24
画像とテキスト主張の局所的な不一致を方向性マルチスケール被覆度で捉え、軽量な分類器で偽情報ペアを検出する手法を提案。
- 自動運転における歩行者行動とシーン理解への視覚言語モデルの応用VLA2025/1/1
大規模視覚言語モデルの知識を効率的な視覚ネットワークに蒸留し、歩行者の行動予測とシーン理解に適用することで、多様で包括的な意味属性の生成と予測精度の向上を実現した。