Wenjuan Zhou
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 会話は不要、視覚に再注力:マルチモーダル大規模言語モデルにおける推論セグメンテーションのための潜在推論VLA2026/9/25
明示的なChain-of-Thoughtの代わりに学習可能な潜在トークンを用いて推論セグメンテーションを行うLIRSegを提案し、セグメンテーション精度と推論効率を向上させた。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
明示的なChain-of-Thoughtの代わりに学習可能な潜在トークンを用いて推論セグメンテーションを行うLIRSegを提案し、セグメンテーション精度と推論効率を向上させた。