Jia Wan
Harbin Institute of Technology, Shenzhen
収録論文 4本 ・ フィジカルAI/ロボット学習
意味マッピングVLA群衆計数
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 都市環境における観測校正と方策依存正則化によるマルチスケール意味マッピング意味マッピング2026/9/28
都市環境での意味マッピングの課題に対し、大規模データセットを構築し、カテゴリ別の観測尤度校正と方策の過結合を防ぐ正則化を提案した研究。
- FocusVLA: 視覚言語行動モデルにおける視覚情報の焦点化VLA2026/3/1
VLAモデルの性能が視覚表現の質ではなく視覚情報の活用方法に制限されることを示し、注意をタスク関連領域に集中させるFocusVLAを提案した。
- 少数ショット視覚言語行動インクリメンタル方策学習VLA2025/4/1
少数の実演から新しい操作タスクを継続的に学習するため、タスク固有プロンプトとタスク関係グラフによる進化戦略を組み合わせたTOPICを提案した論文。
- 移動ドローンによる動画個体計数群衆計数2025/3/1
高速移動ドローンで撮影した群衆動画のデータセットMovingDroneCrowdを構築し、連続フレーム間の共有密度マップを直接推定するSDNetを提案して個体数を計数する。