Lirui Wang
収録論文 14本 ・ フィジカルAI/ロボット学習
映像生成/世界モデルVLAsim2real触覚マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 異種マスク付き自己回帰による実世界の行動-映像ダイナミクスの学習映像生成/世界モデル2025/2/1
異なるロボットの身体・環境・タスクの観察と行動列を統合的に事前学習し、マスク付き自己回帰で映像を予測するモデルHMAを提案。従来のロボット映像生成より高品質かつ15倍高速で、ポリシー評価や合成データ生成に使える映像シミュレータとして機能する。
- 人間との対話による推論時ポリシーステアリングVLA2024/11/1
事前学習済みの生成ポリシーを微調整せずに、人間の介入でサンプリング過程をバイアスし、意図に沿った行動を引き出す枠組みを提案。
- GenSim2: マルチモーダル推論LLMによるロボットデータ生成のスケーリングsim2real2024/10/1
マルチモーダル推論LLMを活用して多様なシミュレーションタスクとデモデータを自動生成し、生成データで学習するマルチタスク方策により実機へのゼロショット転移や実データとの共同学習で性能向上を実現した。
- 異種ロボットデータによる自己受容・視覚学習のスケーリングVLA2024/9/1
異なるロボット身体とタスクのデータを大規模に事前学習し、共有可能なポリシー表現を学習するHPTを提案。未知タスクでの微調整性能を20%以上向上させた。
- 多様な触覚センサとタスクを横断する転移可能な触覚トランスフォーマー触覚2024/6/1
異なる触覚センサとタスクに共通する潜在表現を学習するフレームワークT3を提案し、300万点超の大規模データセットFoTaで事前学習することでゼロショット転移や高精度な接触リッチ操作を実現した。
- PoCo: 異種ロボット学習のためのポリシー合成マニピュレーション2024/2/1
拡散モデルで表現された異なるデータ分布を合成し、マルチモーダル・マルチドメインのデータから汎用的な操作スキルを学習する手法を提案。
- GenSim: Generating Robotic Simulation Tasks via Large Language Models2023/10/1
- Robot Fleet Learning via Policy Merging2023/10/1
- NeRF in the Palm of Your Hand: Corrective Augmentation for Robotics via Novel-View Synthesis2023/1/1
- Does Learning from Decentralized Non-IID Unlabeled Data Benefit from Self Supervision?2022/10/1
- PredictionNet: Real-Time Joint Probabilistic Traffic Prediction for Planning, Control, and Simulation2021/9/1
- Hierarchical Policies for Cluttered-Scene Grasping with Latent Plans2021/7/1
- Goal-Auxiliary Actor-Critic for 6D Robotic Grasping with Point Clouds2020/10/1
- Manipulation Trajectory Optimization with Online Grasp Synthesis and Selection2019/11/1