Jin-Cheng Jhang
収録論文 2本 ・ フィジカルAI/ロボット学習
視覚接地VLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 任意のオープンソースMLLMの部品レベル点接地を強化する手法視覚接地2026/6/28
MLLMの注意機構を利用し、凍結したまま部品レベルの2D点接地を可能にする軽量デコーダを提案した。
- 接地された3D点のアクションヘッド直接注入による空間・タスク汎化の実現VLA/操作2026/6/1
VLAモデルの空間・タスク汎化を改善するため、3D点ベースの接地信号をアクションヘッドに直接注入する軽量モジュールを提案し、LIBERO-PROで成功率を大幅に向上させた。