Jimmy Wu
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboTTT: ロボットポリシーのためのコンテキストスケーリングVLA2026/7/1
ロボットポリシーの視覚運動コンテキストを8Kタイムステップまで拡張し、推論遅延を増やさずに、人間のビデオからのワンショット模倣や長期的タスクの性能向上を実現する手法を提案。
- Vesta: 汎用身体化推論モデルVLA2026/6/1
ロボットのための単一の基盤モデルで、位置推定・空間推論・ナビゲーション・長期計画を統合し、専門モデル群を上回る性能を示した。
- KinDER: ロボット学習と計画のための物理的推論ベンチマークベンチマーク2026/4/1
ロボットの物理的推論能力を評価するためのベンチマークKinDERを提案し、既存手法が多くの環境で課題を抱えることを示した。
- 世界行動モデルはゼロショット方策であるVLA2026/2/1
動画拡散モデルを基盤に未来の世界状態と行動を予測するWorld Action Model「DreamZero」を提案し、実機でVLAを上回る汎化性能と7Hzのリアルタイム閉ループ制御を実現した。
- 残差強化学習によるデータ生成で自己改善する視覚言語行動モデルVLA2025/11/1
VLAモデルの失敗領域を残差RLで探索し、展開分布に沿った軌道を収集・蒸留することで、追加の人間デモなしに性能を自己改善させるフレームワークPLDを提案。
- 視覚運動ポリシー学習のための制約保持データ生成マニピュレーション2025/8/1
単一の専門家軌道から、新しい物体形状や姿勢を含むロボット実演を生成し、実世界にゼロショット転移する閉ループ視覚運動ポリシーを訓練する手法を提案。
- HoMeR: ハイブリッド模倣と全身制御による実環境モバイルマニピュレーションの学習モバイルマニピュレーション2025/6/1
全身制御と絶対/相対のハイブリッド行動を組み合わせ、家庭内でのモバイルマニピュレーションを少数のデモで学習する模倣学習フレームワークを提案。
- 行動の中の視覚:人間の実演から能動的知覚を学ぶマニピュレーション2025/6/1
6自由度のロボット首とVRテレオペレーションを用いて、人間の能動的知覚戦略を実演から直接学習し、視覚遮蔽を含む両腕マニピュレーションタスクで高い性能を達成した。
- TidyBot++: ロボット学習のためのオープンソース全方向移動マニピュレータ移動マニピュレーション2024/12/1
模倣学習による家庭内移動マニピュレーションのデータ収集を容易にするため、動力付きキャスタで全方向移動を実現し、任意のアームを搭載できる低コストなオープンソース移動マニピュレータを提案した。スマホ遠隔操作インタフェースで収集したデータから学習した方策が家庭内タスクを実行できることを示した。
- Points2Plans: 点群から長期計画を生成する構成可能な関係力学モデルマニピュレーション2024/8/1
部分視点の点群と言語指示から、関係力学モデルを連続・記号表現の橋渡しとして使い、長期マニピュレーション計画をゼロショットで生成するフレームワーク。
- 一貫性ポリシー:一貫性蒸留による視覚運動ポリシーの高速化VLA2024/5/1
事前学習済みDiffusion Policyから一貫性蒸留することで、推論を桁違いに高速化しつつ成功率を維持する視覚運動制御ポリシーを提案した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- EquivAct: SIM(3)-Equivariant Visuomotor Policies beyond Rigid Object Manipulation2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- TidyBot: Personalized Robot Assistance with Large Language Models2023/5/1
- Learning Pneumatic Non-Prehensile Manipulation with a Mobile Blower2022/4/1
- Spatial Intention Maps for Multi-Agent Mobile Manipulation2021/3/1
- Spatial Action Maps for Mobile Manipulation2020/4/1
- Real-Time Object Pose Estimation with Pose Interpreter Networks2018/8/1
- SegICP: Integrated Deep Semantic Segmentation and Pose Estimation2017/3/1