Kevin Lin
収録論文 11本 ・ フィジカルAI/ロボット学習
データ生成/移動操作マニピュレーションVLA動画生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HumanoidMimicGen: 全身計画による移動操作のためのデータ生成データ生成/移動操作2026/5/1
ヒューマノイドの移動と操作を模倣学習で訓練するためのデータを自動生成する手法を提案。少数の実演から全身スキルを適応させ、多様なシーンで安定したデータを生成し、実データのみで訓練した場合より20%性能が向上した。
- 視覚運動ポリシー学習のための制約保持データ生成マニピュレーション2025/8/1
単一の専門家軌道から、新しい物体形状や姿勢を含むロボット実演を生成し、実世界にゼロショット転移する閉ループ視覚運動ポリシーを訓練する手法を提案。
- GR00T N1: 汎用人型ロボットのためのオープン基盤モデルVLA2025/3/1
視覚言語モジュールと拡散トランスフォーマを組み合わせた二重システム構成のVLA基盤モデルを提案し、実機・人間動画・合成データで学習して人型ロボットの両手マニピュレーションを実現した。
- DexMimicGen:両腕巧みな操作のための模倣学習による自動データ生成マニピュレーション2024/10/1
少数の人間デモからヒューマノイドロボットの両腕巧みな操作の軌道を自動生成するシステムを提案し、60のデモから21Kのデモを生成して実機タスクに展開した。
- SlowFast-VGen:行動駆動型長尺動画生成のための低速・高速学習動画生成2024/10/1
人間の補完的学習システムに着想を得て、低速学習(世界動態の拡散モデル)と高速学習(時間LoRAによるエピソード記憶)を組み合わせ、行動に基づく長尺動画生成の一貫性を向上させる手法を提案。
- 一貫性ポリシー:一貫性蒸留による視覚運動ポリシーの高速化VLA2024/5/1
事前学習済みDiffusion Policyから一貫性蒸留することで、推論を桁違いに高速化しつつ成功率を維持する視覚運動制御ポリシーを提案した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Text2Motion: From Natural Language Instructions to Feasible Plans2023/3/1
- Combining optimal control and learning for autonomous aerial navigation in novel indoor environments2021/12/1
- robosuite: A Modular Simulation Framework and Benchmark for Robot Learning2020/9/1