Seokmin Lee
収録論文 1本 ・ フィジカルAI/ロボット学習
視覚状態表現学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 1トークンでのピクセルレベルシーン理解:視覚状態には「何がどこにあるか」の構成が必要視覚状態表現学習2026/3/1
ロボットの視覚状態表現学習において、シーンの意味的要素とその空間位置を同時に符号化する「何がどこにあるか」の表現が重要であると主張し、大域から局所への再構成目的に基づくCroBoフレームワークを提案した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
ロボットの視覚状態表現学習において、シーンの意味的要素とその空間位置を同時に符号化する「何がどこにあるか」の表現が重要であると主張し、大域から局所への再構成目的に基づくCroBoフレームワークを提案した。