Angjoo Kanazawa
UC Berkeley
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 世界運動モデル:SE(3)軌道の柔軟な系列モデリングVLA2026/10/1
動的3D世界の要素を剛体SE(3)軌道として表現し、フローマッチングによる系列モデリングで予測・補間・制御・IK・リターゲティング・方策学習を統一的に扱う手法を提案。
- 反実仮想動画生成によるスケーラブルなヒューマノイドの移動操作移動操作2026/9/29
少数の実動画から反実仮想の人間-物体インタラクション動画を大量生成し、実→シミュ→実のパイプラインで物理的に妥当な軌道に変換して、多様な物体の運搬を実機で実現する方策を学習した。
- オープンデータ・訓練・評価によるスケーラブルな行動クローニング行動クローニング2026/6/1
大規模な遠隔操作データセットABC-130K(3500時間、13万エピソード)とオープンソースのハードウェア・訓練・シミュレーション基盤を公開し、行動クローニングの再現可能な研究基盤を提供した。
- VLK: 再構築シーンでの合成インタラクションによるヒューマノイドの移動操作学習ヒューマノイド/移動操作/sim2real2026/6/1
3Dガウススプラッティングで再構築した屋内シーンで、視覚・言語・運動のペアデータを合成生成し、ヒューマノイドの移動操作ポリシーを学習する手法を提案。実機Unitree G1でナビゲーションと物体運搬を実証した。
- 遊び心のあるエージェント型ロボット学習スキル獲得2026/6/1
ロボットエージェントが指示なしで自己主導の「遊び」を通じてスキルを獲得し、後続タスクに活用する手法を提案。コード生成エージェントチーム(RATs)が探索タスクを生成・実行・検証・修正し、成功体験をコードスキルライブラリに蓄積する。
- 知覚型ヒューマノイドパルクール:モーションマッチングによる動的人間スキルの連鎖歩行2026/2/1
人間の動的スキルをモーションマッチングで連鎖させ、深層知覚と強化学習により、ヒューマノイドが障害物を乗り越え・登り・跳び越え・転がり落ちるパルクールを自律実行できるフレームワークを提案。
- フローポリシー勾配によるロボット制御強化学習2026/2/1
フローマッチングを用いたポリシー勾配法を改良し、脚式移動やヒューマノイド動作追従、マニピュレーション、sim-to-real転移を実現した研究。
- マルチエージェント相互作用のための拡散強制シーケンスモデリング動作生成2025/12/1
複数人の動作生成を単一の自己回帰拡散モデルで統一的に扱い、ペア・多人数の予測や長期生成を可能にした研究。
- TWIST2: スケーラブルでポータブルな全身ヒューマノイドデータ収集システムヒューマノイド2025/11/1
VRと低コストのロボット首を用いてモーションキャプチャ不要でヒューマノイドの全身遠隔操作とデータ収集を実現し、15分で100件のデモをほぼ100%の成功率で収集できるシステムを開発した。
- OmniRetarget: 相互作用を保持するヒューマノイド全身移動操作・シーンインタラクション向けデータ生成sim2real2025/9/1
人間・地形・物体間の空間的・接触的関係をインタラクションメッシュで明示的に保持しながら運動をリターゲティングし、物理的に妥当で多様な全身移動操作データを生成する手法を提案。
- Viser: Pythonによる命令型Webベース3D可視化ライブラリ可視化2025/7/1
コンピュータビジョンとロボティクス向けの3D可視化ライブラリViserを提案。命令型APIとWebベースビューアにより、最小限のセットアップで拡張可能な3Dシーンと2D GUIを提供する。
- フローマッチング方策勾配強化学習2025/7/1
フローマッチングを方策勾配法に統合したFPOを提案し、拡散スタイルの方策を連続制御タスクで学習できることを示した。
- アイ・ロボット:見ることで行動する知覚-行動ループのBC-RL学習マニピュレーション2025/6/1
自由に回転する眼球を強化学習で制御し、模倣学習とRLのループで手と眼を協調させて広域作業空間でのマニピュレーションを実現した研究。
- PyRoki: ロボット運動学最適化のためのモジュラーツールキット運動学最適化2025/5/1
運動学的最適化問題を解くためのモジュラーで拡張可能なクロスプラットフォームツールキットを提案し、CPU/GPU/TPUで動作し、既存のGPUライブラリより高速で低誤差に収束することを示した。
- 視覚的模倣による文脈依存型ヒューマノイド制御全身制御2025/5/1
日常動画から人間と環境を再構成し、階段昇降や椅子への着座など周囲の状況に応じた全身制御方策をヒューマノイドに学習させるreal-to-sim-to-realパイプラインを提案。
- Agent-to-Sim: 日常的な長期動画から対話型行動モデルを学習sim2real2024/10/1
スマホで撮影したペットや人間の長期モノラルRGBD動画から、3Dエージェントの対話型行動モデルを学習し、実世界からシミュレーションへの転移を可能にするフレームワークを提案。
- ロボットが見てロボットが行う:単眼4D再構成による関節物体操作の模倣模倣学習2024/9/1
単眼RGB動画1本から関節物体の3Dパーツ運動を4D-DPMで再構成し、その軌道を両腕ロボットで再現する模倣手法を提案。
- State of the Art on Diffusion Models for Visual Computing2023/10/11
- Language Embedded Radiance Fields for Zero-Shot Task-Oriented Grasping2023/9/1