Anna-Maria Halacheva
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAシーン理解3Dシーン理解
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 2D VLMを3Dプログラマに変えるタスク適応型グラウンディングVLA2026/10/1
2Dの視覚言語モデルに座標系の統一とタスク適応フィードバックを組み合わせ、再学習なしで3D理解・操作・生成を可能にするフレームワーク3D-Progを提案。
- GaussianVLM: 言語対応ガウシアンスプラットによるシーン中心3D視覚言語モデルVLA2025/7/1
3Dガウシアンスプラットに言語特徴を直接埋め込み、物体検出器に依存せずに3Dシーン理解と身体性推論を行う視覚言語モデルを提案した。
- スキャンから行動へ:実世界スキャンを活用した身体性シーン理解シーン理解2025/7/1
実世界の3Dスキャンデータと注釈をUSDで統合し、LLMによるシーン編集とロボットシミュレーションでの政策学習に応用した研究。
- Articulate3D: 3Dシーンを汎用シーン記述として包括的に理解する3Dシーン理解2024/12/1
関節物体の高品質アノテーションを備えた3D屋内シーンデータセットArticulate3Dと、部位分割と運動属性を同時予測する統一フレームワークUSDNetを提案した論文。