Pengna Li
収録論文 4本 ・ フィジカルAI/ロボット学習
触覚VLA/ナビゲーションナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TouchThinker:大規模データと行動認識表現による触覚常識推論のオープンワールドへの拡張触覚2026/6/10
触覚常識推論をオープンワールドに拡張するため、大規模データセットと行動認識表現を備えた触覚言語フレームワークTouchThinkerを提案した。
- SpaAct: 空間活性化遷移学習とカリキュラム適応による視覚言語ナビゲーションVLA/ナビゲーション2026/4/30
視覚言語ナビゲーション(VLN)のためのVLM適応フレームワークSpaActを提案。後方行動推論と前方遷移予測の2つの空間活性化タスクと、TriPAカリキュラム学習により動的空間認識を獲得し、VLN-CEベンチマークでSOTAを達成。
- 考える前に進む:画像目標ナビゲーションのための階層的推論ナビゲーション2026/4/1
画像目標ナビゲーションを高レベル計画と低レベル実行に分解し、視覚言語モデルで短期的計画を生成して強化学習ポリシーを導く階層的フレームワークHRNavを提案。迷いを減らすペナルティも導入し、シミュレーションと実環境で有効性を実証した。
- HiMemVLN:階層的記憶システムによるオープンソースゼロショット視覚言語ナビゲーションの信頼性向上VLA2026/3/1
オープンソースLLMを用いた視覚言語ナビゲーションにおける「ナビゲーション健忘」問題を分析し、階層的記憶システムを導入することで性能を約2倍に改善した研究。