Francis Engelmann
収録論文 6本 ・ フィジカルAI/ロボット学習
3Dシーン理解モバイルマニピュレーションマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 屋内空間のための階層的かつ全体的なオープンボキャブラリー機能3Dシーングラフ3Dシーン理解2026/5/1
機能的な3Dシーングラフの構築において、テーブルトップ上の密集した物体や多階層の機能関係を扱う新しいパイプラインを提案し、2D視覚グラウンディングと3Dグラフ最適化により頑健なグラフ構造を復元する。
- SceneTeract: 3Dシーンにおけるエージェント機能アフォーダンスとVLMの接地3Dシーン理解2026/3/31
3Dシーンの機能性をエージェントの制約下で検証するフレームワークを提案し、複雑な活動を原子アクションに分解して幾何学的シミュレーションで検証する。また、VLMの機能推論能力の評価と、報酬エンジンとしての活用も行う。
- HoMeR: ハイブリッド模倣と全身制御による実環境モバイルマニピュレーションの学習モバイルマニピュレーション2025/6/1
全身制御と絶対/相対のハイブリッド行動を組み合わせ、家庭内でのモバイルマニピュレーションを少数のデモで学習する模倣学習フレームワークを提案。
- SLAG: スケーラブルな言語拡張ガウシアンスプラッティング3Dシーン理解2025/5/1
2D視覚言語モデルの特徴を3Dガウシアンシーンに統合し、損失関数不要の並列化可能な手法とベクトルデータベースで大規模シーンの言語埋め込みを高速化したマルチGPUフレームワーク。
- Spot-Compose: 点群におけるオープンボキャブラリ物体検索と引き出し操作のフレームワークマニピュレーション2024/4/1
市販の3Dスキャナで得た点群を使い、オープンボキャブラリなインスタンス分割と把持姿勢推定を組み合わせて、実環境で物体の動的ピッキングと引き出し開けを行うフレームワークを構築した。
- ICGNet: A Unified Approach for Instance-Centric Grasping2024/1/1