Hasitha Gallella
収録論文 1本 ・ フィジカルAI/ロボット学習
4D理解/視覚言語モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CL4D: 動的シーンにおける視覚言語推論のための対照言語-4D事前学習4D理解/視覚言語モデル2026/8/19
動的点群を直接扱う初の基盤4D視覚エンコーダを提案し、言語との対照学習で時空間幾何表現を獲得。これを用いた4D視覚言語モデルも構築し、動的シーン理解を実現した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
動的点群を直接扱う初の基盤4D視覚エンコーダを提案し、言語との対照学習で時空間幾何表現を獲得。これを用いた4D視覚言語モデルも構築し、動的シーン理解を実現した。