Lihuang Fang
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA3Dシーン理解
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Capek 0.5: 実行中心の視覚言語モデルによる具現化知能VLA2026/8/7
ロボットの実行プロセスに着目し、空間推論・時間理解・行動誘導・状態検証の4つの能力を専門家モデルで学習し、統合する視覚言語モデルCapek 0.5を提案した。
- FLM-Occ: フィードフォワード尤度最大化による効率的な屋内占有予測3Dシーン理解2026/6/1
屋内占有予測をボクセル分布推定として再定式化し、ガウスプリミティブの分布を大域的に最適化する新しいフレームワークを提案。従来の局所的なボクセル分類に基づく手法より少ないプリミティブで高精度かつ高速な予測を実現した。