Md Selim Sarowar
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 結果ボトルネックによる操作十分表現の学習マニピュレーション2026/9/2
行動条件付き結果ボトルネックを用いて、操作に十分な確率的表現を学習し、把持選択や適応に応用した研究。
- GaussVLA:幾何認識型空間推論を備えた視覚言語行動モデルVLA2026/8/25
視覚言語行動モデルに3Dガウス表現と深度認識型思考連鎖を導入し、空間操作性能を向上させた。
- GST-VLA: 構造化ガウス空間トークンを用いた3次元深度認識型視覚言語行動モデルVLA2026/3/1
視覚観測を3次元ガウスプリミティブに変換し、深度認識型の思考連鎖推論と行動生成を統合したVLAモデルを提案した。