Weikang Wan
収録論文 11本 ・ フィジカルAI/ロボット学習
マニピュレーションVLAsim2real強化学習/模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 巧みな操作のためのクロスエンボディメント世界モデルのスケーリングマニピュレーション2025/11/1
人間とロボットの手を3D粒子で表現し、エンドエフェクタの粒子変位場を行動として定義することで、異なる身体構造を超えて共有できる世界モデルを学習し、新しいハードウェアでの操作制御を実現した。
- 強化学習で獲得した両腕ロボットスキルの計画とスケジューリングマニピュレーション2025/10/1
強化学習で訓練した単腕・両腕のプリミティブスキルをライブラリ化し、Transformerベースのプランナがスキルの離散的なスケジュールと連続パラメータを同時予測することで、長期的な接触を伴う両腕マニピュレーションを効率的に計画する階層的フレームワークを提案した。
- LodeStar: 人間のデモンストレーションからの合成データ拡張による長期的器用操作マニピュレーション2025/8/1
人間のデモを基礎モデルでスキルに分解し、強化学習で合成データを生成して、長期的な器用操作を実現する学習フレームワークを提案。
- ManiTaskGen: 視覚言語エージェントの身体的意思決定を評価・改善するための包括的タスク生成器VLA2025/5/1
任意のシーンに対して多様で実行可能な移動操作タスクを自動生成するシステムを提案し、シミュレーションと実環境でその有効性を示すとともに、生成タスクを用いたベンチマーク構築とエージェント性能向上手法を提示した。
- RoboVerse:スケーラブルで汎化可能なロボット学習のための統合プラットフォーム・データセット・ベンチマークsim2real2025/4/1
複数のシミュレータとロボット形態に対応する統合シミュレーション基盤MetaSimと、高品質な合成データセット、模倣学習・強化学習の統一ベンチマークを提供するフレームワークを提案。
- DexMimicGen:両腕巧みな操作のための模倣学習による自動データ生成マニピュレーション2024/10/1
少数の人間デモからヒューマノイドロボットの両腕巧みな操作の軌道を自動生成するシステムを提案し、60のデモから21Kのデモを生成して実機タスクに展開した。
- DiffTORI: 深層強化学習と模倣学習のための微分可能な軌道最適化強化学習/模倣学習2024/2/1
軌道最適化をポリシー表現として用い、そのコストとダイナミクス関数を微分可能最適化によりエンドツーエンドで学習する手法を提案し、強化学習と模倣学習の両方で従来手法を上回る性能を達成した。
- LOTUS: Continual Imitation Learning for Robot Manipulation Through Unsupervised Skill Discovery2023/11/1
- UniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning2023/4/1
- UniDexGrasp: Universal Robotic Dexterous Grasping via Learning Diverse Proposal Generation and Goal-Conditioned Policy2023/3/1
- Learning Category-Level Generalizable Object Manipulation Policy via Generative Adversarial Self-Imitation Learning from Demonstrations2022/3/1