William Liang
収録論文 8本 ・ フィジカルAI/ロボット学習
器用操作/データ生成模倣学習世界モデルVLAsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 私の真似をして:日常の人間ビデオからの器用な操作データ器用操作/データ生成2026/6/17
単眼RGBの人間ビデオから手と物体のインタラクションを再構築し、多指ロボットハンドの実行可能な操作軌道へとリターゲティングするアルゴリズムを提案した。
- Tether: 対応関係駆動の軌道ワーピングによる自律的機能プレイ模倣学習2026/3/1
少数のデモから意味的キーポイント対応を用いてアクションをワープするオープンループポリシーを提案し、それを用いて実世界で自律的にマルチタスクのプレイデータを収集・改善する手法を紹介する。
- DreamDojo: 大規模人間動画から学ぶ汎用ロボット世界モデル世界モデル2026/2/1
44,000時間の一人称視点人間動画から汎用的なロボット世界モデルを学習し、連続潜在行動を代理ラベルとして活用することで、巧みな操作の物理理解と精密な行動制御を実現した研究。
- 世界行動モデルはゼロショット方策であるVLA2026/2/1
動画拡散モデルを基盤に未来の世界状態と行動を予測するWorld Action Model「DreamZero」を提案し、実機でVLAを上回る汎化性能と7Hzのリアルタイム閉ループ制御を実現した。
- Eurekaverse:大規模言語モデルによる環境カリキュラム生成sim2real2024/11/1
大規模言語モデルを用いて、四足ロボットのパルクール学習のための難易度が漸進的に上がる環境を自動生成する手法を提案し、実世界への転移に成功した。
- DrEureka: 言語モデルが導くSim-to-Real転送sim2real2024/6/1
大規模言語モデルを活用し、報酬関数とドメインランダム化を自動設計することで、四足歩行や器用な操作のシミュレーションから実機への転送を人手を介さず実現した研究。
- Eureka: Human-Level Reward Design via Coding Large Language Models2023/10/1
- LIV: Language-Image Representations and Rewards for Robotic Control2023/6/1