Benjamin Busam
収録論文 23本 ・ フィジカルAI/ロボット学習
関節物体認識セグメンテーション変形モデリング3Dシーングラフ生成物体姿勢推定VLASLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Track2Art: 2D点トラッカーからの運動中心型関節物体モデル復元関節物体認識2026/9/23
RGB-D動画から物体の点追跡を3D軌跡に変換し、運動の一貫性を手がかりに関節物体の剛体部品と関節関係を推定する手法を提案。
- SOS!:モデルフリーセグメンテーションのための合理化されたオブジェクト条件付きトランスフォーマーセグメンテーション2026/8/15
3Dモデルを必要とせず、参照画像1枚だけで未知物体を正確にセグメンテーションする新しい手法を提案。オブジェクト条件付きトランスフォーマーにより、マスク生成と対象特定を単一のフィードフォワードで統合し、効率と精度を両立した。
- ODeform: ニューラルODEによる連続4次元変形運動の学習変形モデリング2026/7/22
変形物体の連続的な動きをニューラル常微分方程式でモデル化し、離散時間ステップを不要にしつつ効率的に予測する手法を提案した。
- DeWorldSG: ワールドモデル事前知識による深度認識3Dセマンティックシーングラフ生成3Dシーングラフ生成2026/7/1
RGB-Dシーケンスから時間的に安定した3Dセマンティックシーングラフを生成するフレームワークを提案。物体を確率的3Dノードとして表現し、ワールドモデルの事前知識で関係性を補完することで精度を大幅に向上させた。
- 任意参照からのモデルフリー物体姿勢推定:PANY物体姿勢推定2026/6/22
CADモデルや追加学習なしで、任意の参照画像から未知物体の6D姿勢を推定する統一フレームワークPANYを提案。RGBとRGB-Dの両対応で、単一または疎な参照ビューから頑健に姿勢を推定する。
- STARE-VLA:視覚言語行動モデルの微調整のための段階的ステージ認識強化学習VLA2025/12/1
長期的な行動軌跡を意味のある段階に分解し、段階ごとに密な強化学習信号を与えることで、VLAモデルの微調整を安定化・高精度化する手法を提案。
- 深度センサーなしでRGB-D精度を実現する単眼SLAMSLAM2025/10/1
単眼深度推定・キーポイント検出・インスタンスセグメンテーションの事前学習モデルを組み合わせ、深度センサーなしでRGB-Dレベルの精度をリアルタイムに達成するSLAMシステムを提案。
- SG-Bot: Object Rearrangement via Coarse-to-Fine Robotic Imagination on Scene Graphs2023/9/1
- 3D Adversarial Augmentations for Robust Out-of-Domain Predictions2023/8/1
- IPCC-TP: Utilizing Incremental Pearson Correlation Coefficient for Joint Multi-Agent Trajectory Prediction2023/3/1
- On the Importance of Patient Acceptance for Medical Robotic Imaging2023/2/1
- Robotic Navigation Autonomy for Subretinal Injection via Intelligent Real-Time Virtual iOCT Volume Slicing2023/1/1
- Segmenting Known Objects and Unseen Unknowns without Prior Knowledge2022/9/1
- MonoGraspNet: 6-DoF Grasping with a Single RGB Image2022/9/1
- DA$^2$ Dataset: Toward Dexterity-Aware Dual-Arm Grasping2022/8/1
- DemoGrasp: Few-Shot Learning for Robotic Grasping with Human Demonstration2021/12/1
- RSV: Robotic Sonography for Thyroid Volumetry2021/12/1
- 3D-VField: Adversarial Augmentation of Point Clouds for Domain Generalization in 3D Object Detection2021/12/1
- ColibriDoc: An Eye-in-Hand Autonomous Trocar Docking System2021/11/1
- CertainNet: Sampling-free Uncertainty Estimation for Object Detection2021/10/1
- R4Dyn: Exploring Radar for Self-Supervised Monocular Depth Estimation of Dynamic Scenes2021/8/1
- Generic Primitive Detection in Point Clouds Using Novel Minimal Quadric Fits2019/1/1
- A Minimalist Approach to Type-Agnostic Detection of Quadrics in Point Clouds2018/3/1