Bowen Wen
NVIDIA
収録論文 38本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PointZero: 転移可能な3Dダイナミクス学習のための3D点追跡補完3Dダイナミクス/事前学習2026/9/16
ロボットの行動ラベルなしで、RGB-D観測と部分的な3D軌跡から全点の未来軌跡を予測する事前学習手法を提案し、下流のダイナミクス予測や模倣学習で有効性を示した。
- RoboTok: 人間のデモンストレーション検索と器用な操作学習のためのインターネット規模データエンジンデータエンジン/操作学習2026/9/2
クエリ動画から関連する人間の操作デモをウェブ動画から検索し、器用なロボットポリシーの訓練に利用するデータエンジンを提案。3D手の軌跡に基づく潜在動作空間を学習し、視点や外観の変化に頑健な検索を実現。
- Hydra-0: 汎用世界モデリングと制御のためのアクションフロー世界モデル2026/8/18
ロボットの動作をピクセル運動として表現するアクションフローを用いた汎用世界モデルを提案し、動作誤差を大幅に低減し、ゼロショット合成やデータ効率的な適応を実現した。
- 人間のデモから接触力ガイダンスを用いた器用操作の学習器用操作2026/7/1
人間のデモから物体に加わる力・トルク空間でガイダンスを作り、強化学習で長期的な器用操作を学習するフレームワークCHORDを提案。大規模ベンチマークで高い成功率を示し、実世界にも転移可能。
- SimFoundry: ポリシー学習と評価のためのモジュール式自動シーン生成sim2real2026/6/1
実世界のビデオからシミュレーション用のシーンを自動生成し、多様なバリエーションを作成してロボットポリシーの訓練と評価を行うシステムを提案。シミュレーションでの評価が実世界性能を強く予測し、訓練時のバリエーション追加が成功率を向上させることを示した。
- Vesta: 汎用身体化推論モデルVLA2026/6/1
ロボットのための単一の基盤モデルで、位置推定・空間推論・ナビゲーション・長期計画を統合し、専門モデル群を上回る性能を示した。
- GRAIL: 3Dアセットとビデオ事前知識から人型ロコ操作を生成ロコ操作2026/6/1
物理環境や遠隔操作を必要とせず、3Dアセットとビデオ基盤モデルの事前知識を用いて、人型ロボットの全身操作デモを仮想的に生成するパイプラインを提案した。
- Fast-FoundationStereo:リアルタイムゼロショットステレオマッチングステレオマッチング2025/12/1
ステレオ基盤モデルのゼロショット汎化性能を保ちつつ、知識蒸留・NAS・構造的プルーニングで高速化し、リアルタイム動作を実現した。
- Refinery: 接触の多いタスク向け能動的ファインチューニングと展開時最適化マニピュレーション2025/10/1
ベイズ最適化によるファインチューニングとGMMベースの初期化選択で、接触の多い組立タスクの成功率を91.51%まで向上させ、多部品の長期組立も可能にした。
- DeLTa: 実演と言語ガイドによる新規透明物体の操作マニピュレーション2025/10/1
透明物体の長期的な精密操作を実現するため、深度推定・6D姿勢推定・視覚言語計画を統合し、1回の実演から新規物体へ汎化するフレームワークを提案。
- Any6D: 未知物体のモデルフリー6D姿勢推定6D姿勢推定2025/3/1
単一のRGB-Dアンカー画像のみから未知物体の6D姿勢とサイズを推定するモデルフリー手法を提案し、5つのデータセットで最先端性能を達成した。
- FoundationStereo: ゼロショットステレオマッチングの基盤モデルステレオ深度推定2025/1/1
大規模合成データと単眼基盤モデルの活用により、未知の環境でも高精度にステレオ深度推定を行う基盤モデルを構築した。
- SPOT: 物体中心操作のためのSE(3)姿勢軌道拡散模倣学習2024/11/1
物体のSE(3)姿勢軌道をタスク表現として用い、拡散ポリシーを条件付ける物体中心模倣学習フレームワークを提案。iPhoneで撮影した8つの実演のみで実世界タスクを制約遵守しつつ完遂した。
- SkillMimicGen: スキル学習と展開を効率化する自動デモ生成模倣学習2024/10/1
少数の人間デモをスキルに分割・適応・連結して大量のデモを自動生成し、ハイブリッドスキルポリシーで長期的タスクの模倣学習と実機転移を実現する。
- FORGE: 不確実性下での接触の多いマニピュレーションのための力誘導探索sim2real2024/8/1
力閾値とダイナミクスランダム化を組み合わせてシミュレーションで学習し、姿勢の不確実性がある実機でも力に基づいて接触の多い作業を安全に遂行できる方策を実現した。
- AutoMate: 多様な形状に対応する専門家・汎用組み立てポリシーマニピュレーション2024/7/1
100種類の組み立てタスクのデータセットと並列シミュレーション環境を構築し、部品特化型と汎用型の組み立てポリシーを学習。シミュレーションから実機へのゼロショット転移を実現した。
- キャンパス実証実験における低速自動運転シャトルの自己位置推定と知覚に基づく制御自動運転2024/7/1
GPSとIMU、3D LiDAR SLAMを組み合わせ、GPSが使えない環境でも低速自動運転シャトルを制御する手法を実証した論文。
- 未知の関節物体のデジタルツイン構築のためのニューラル陰的表現3D再構成2024/4/1
異なる関節状態の2つのRGBDスキャンから、未知の関節物体の形状と関節モデルを再構成し、デジタルツインを構築する手法を提案。
- DeformGS: Scene Flow in Highly Deformable Scenes for Deformable Object Manipulation2023/12/1
- FoundationPose: Unified 6D Pose Estimation and Tracking of Novel Objects2023/12/1
- MimicGen: A Data Generation System for Scalable Robot Learning using Human Demonstrations2023/10/1
- Diff-DOPE: Differentiable Deep Object Pose Estimation2023/10/1
- HANDAL: A Dataset of Real-World Manipulable Object Categories with Pose Annotations, Affordances, and Reconstructions2023/8/1
- BundleSDF: Neural 6-DoF Tracking and 3D Reconstruction of Unknown Objects2023/3/1
- Parallel Inversion of Neural Radiance Fields for Robust Pose Estimation2022/10/1
- RGB-Only Reconstruction of Tabletop Scenes for Collision-Free Manipulator Control2022/10/1
- One-Shot Neural Fields for 3D Object Understanding2022/10/1
- Learning Sensorimotor Primitives of Sequential Manipulation Tasks from Visual Demonstrations2022/3/1
- You Only Demonstrate Once: Category-Level Manipulation from Single Visual Demonstration2022/1/1
- Complex In-Hand Manipulation via Compliance-Enabled Finger Gaiting and Multi-Modal Planning2022/1/1
- CaTGrasp: Learning Category-Level Task-Relevant Grasping in Clutter from Simulation2021/9/1
- BundleTrack: 6D Pose Tracking for Novel Objects without Instance or Category-Level 3D Models2021/8/1
- Vision-driven Compliant Manipulation for Reliable, High-Precision Assembly Tasks2021/6/1
- Data-driven 6D Pose Tracking by Calibrating Image Residuals in Synthetic Domains2021/5/1
- se(3)-TrackNet: Data-driven 6D Pose Tracking by Calibrating Image Residuals in Synthetic Domains2020/7/1
- Task-driven Perception and Manipulation for Constrained Placement of Unknown Objects2020/6/1
- Robust, Occlusion-aware Pose Estimation for Objects Grasped by Adaptive Hands2020/3/1
- Scene-level Pose Estimation for Multiple Instances of Densely Packed Objects2019/10/1