Shubham Tulsiani
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視点一般化可能な視覚模倣学習ポリシーに何が重要か:実証研究模倣学習2026/9/26
視覚模倣学習において、密な視覚トークンの保持と幾何学的推論を行う行動ヘッドが視点一般化に有効であることを実験的に示し、シミュレーションから実世界へのゼロショット転移も実現した。
- πR²: リアクティブなリアルタイムフローポリシーマニピュレーション2026/7/1
大規模な事前学習済みバックボーンを用いたアクションチャンキング型のフローポリシーを、リアクティブかつリアルタイムに動作させる手法を提案。高速チャネルと低速チャネルを分離し、遅延適応型のフロースケジュールにより、動的な閉ループ制御を実現する。
- GHOST: ロボット操作の汎化を実現する階層的サブゴールポリシーマニピュレーション2026/6/8
多視点RGB-D観測から3Dエンドエフェクタのポーズを予測する高レベルポリシーと、その目標を達成する低レベルコントローラを組み合わせた階層的枠組みを提案し、操作タスクの汎化性能を向上させた。
- Dex4D: タスク非依存の点追跡ポリシーによるSim-to-Real巧みな操作マニピュレーション2026/2/1
シミュレーションでタスク非依存の3D点追跡ポリシーを学習し、実世界の多様な巧みな操作タスクにゼロショット転移するフレームワークを提案。
- CRISP: 平面プリミティブを用いた単眼動画からの接触誘導型Real2Simsim2real2025/12/1
単眼動画から人間とシーンの接触を手がかりに平面プリミティブでシーン形状を復元し、物理的に妥当な人間動作とシミュレーション可能な環境を生成する手法。
- DemoDiffusion:事前学習済み拡散ポリシーを用いた一回の人間模倣模倣学習2025/6/1
人間の実演を一回だけ模倣してロボットに操作タスクを実行させる手法。運動学的リターゲティングで得た粗い軌道を、事前学習済みの汎用拡散ポリシーで修正することで、タスク固有の訓練や人間-ロボットのペアデータなしに新しいタスクやシーンに適応できる。
- Web2Grasp: ウェブ画像の手と物体のインタラクションから機能的な把持を学習マニピュレーション2025/5/1
ウェブ画像から人間の手と物体の3Dインタラクションを復元し、ノイズ除去と物理シミュレーションを経て、多指ロボットハンドの機能的な把持を学習する手法を提案。
- Gen2Act: 人間動画生成を活用した汎用ロボットマニピュレーションマニピュレーション2024/9/1
ウェブデータで学習した人間動画生成モデルを使い、生成された動画を条件にロボット方策を学習することで、未見物体や新規動作への汎化を実現した。
- Track2Act: インターネット動画からの点トラック予測による汎化可能なロボットマニピュレーションマニピュレーション2024/5/1
ウェブ上の人間やロボットの動画から画像内の点の動きを予測し、それを物体の剛体変換に変換してロボットの手先軌道を生成することで、未見の物体や場面でも適応なしに操作できる汎用的なマニピュレーション手法を提案した。
- Towards Generalizable Zero-Shot Manipulation via Translating Human Interaction Plans2023/12/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- RoboAgent: Generalization and Efficiency in Robot Manipulation via Semantic Augmentations and Action Chunking2023/9/1
- Visual Affordance Prediction for Guiding Robot Exploration2023/5/1
- Manipulate by Seeing: Creating Manipulation Controllers from Pre-Trained Representations2023/3/1
- Affordance Diffusion: Synthesizing Hand-Object Interactions2023/3/1
- Zero-Shot Robot Manipulation from Passive Human Videos2023/2/1
- A Differentiable Recipe for Learning Visual Non-Prehensile Planar Manipulation2021/11/1
- Where2Act: From Pixels to Actions for Articulated 3D Objects2021/1/1
- Visual Imitation Made Easy2020/8/1
- Use the Force, Luke! Learning to Predict Physical Forces by Simulating Effects2020/3/1
- Object-centric Forward Modeling for Model Predictive Control2019/10/1
- Efficient Bimanual Manipulation Using Learned Task Schemas2019/9/1