Kuanning Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA/世界モデルVLA/操作模倣学習/行動転移sim2realVLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- τ0-WM: ロボット操作のための統合ビデオ・アクション世界モデルVLA/世界モデル2026/6/1
ロボット操作のための、ポリシー学習・ビデオ予測・行動評価を単一の未来予測フレームワークに統合した世界モデルを提案。実ロボットデータ約27,300時間で訓練し、推論時に候補行動のサンプリングと評価・修正を行うことで、長期的で細かい操作タスクで高い性能を示した。
- OFlow: 物体認識を組み込んだ時間的フローマッチングによる堅牢なロボット操作VLA/操作2026/4/1
ロボット操作のためのVLAモデルに、物体認識を組み込んだ時間的フローマッチングを導入し、将来予測と物体認識を統一した潜在空間で行うことで、分布シフト下での堅牢性を向上させた。
- OCRA: 3Dと触覚の事前知識を用いた物体中心学習による人間からロボットへの行動転移模倣学習/行動転移2026/3/1
人間のデモ動画からロボットの操作行動を学習する物体中心フレームワークOCRAを提案。3D点群と触覚情報を統合し、拡散ポリシーでロバストな操作を実現する。
- SCOOP'D: Sim2Real生成ポリシーによる混合液固形物のすくい取り学習sim2real2025/10/1
OmniGibsonシミュレータで特権情報を用いたすくい取りデモを収集し、拡散モデルによる生成ポリシーで観測入力から模倣学習することで、実世界でのゼロショットすくい取りを実現した。
- 時空間認識を組み込んだ視覚運動拡散ポリシー学習VLA2025/7/1
動的ガウス世界モデルを用いて3D空間・4D時空間認識を拡散ポリシーに組み込み、シミュレーションと実機で成功率を向上させた視覚模倣学習手法。
- 片手で複数物体を連続把持するSeqMultiGraspマニピュレーション2025/3/1
4本指のAllegro Handで、1つ目の物体を落とさずに2つ目の物体を連続して把持するシステムを提案。拡散モデルで把持姿勢を生成し、シミュレーションと実機で検証した。