Geng Chen
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションデータセット/模倣学習ヒューマノイド制御4D再構成VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- トレース条件付きVLA計画による長期的操作マニピュレーション2026/4/1
長期的な操作タスクを、タスク管理VLMが現在の観察から残りの計画を予測し、視覚的トレースを実行VLAに提供することで、短期的なVLA実行を長期的な指示追従に拡張するフレームワークを提案。
- EgoVerse:世界各地から収集したロボット学習用の自己中心視点人間データセットデータセット/模倣学習2026/4/1
人間の自己中心視点のデモデータを大規模に収集・共有するプラットフォームとデータセットを構築し、人間データからロボットへの転移学習の大規模実験を行った。
- In-N-On: 野生データとタスク特化データで自己中心視マニピュレーションをスケールアップマニピュレーション2025/11/1
自己中心視データを「野生のデータ」と「タスク特化データ」に分類し、1000時間超の多様なデータで言語条件付きフローマッチング方策Human0を学習。人間とヒューマノイドのギャップを埋め、指示追従や少数ショット学習、ロバスト性向上を実現した。
- HuB: 極限ヒューマノイドバランスの学習ヒューマノイド制御2025/5/1
ヒューマノイドロボットが片足立ちや高蹴りなどの極限的なバランス課題を強化学習で獲得するための、参照動作修正・バランス認識方策学習・sim-to-realロバスト訓練を統合したフレームワークを提案。
- FP3: ロボットマニピュレーションのための3D基盤ポリシーマニピュレーション2025/3/1
点群入力を用いた大規模3D基盤ポリシーモデルFP3を提案し、80回のデモで新規タスクを90%以上の成功率で学習できることを実機で示した。
- 自己教師あり単眼4Dシーン再構成による一人称視点動画の理解4D再構成2024/11/1
一人称視点動画からカメラ内部パラメータ・カメラ姿勢・動画深度を自己教師あり学習で推定し、高密度な4Dシーン再構成を高速に行うモデルEgoMono4Dを提案した。
- 言語から計画抽象を学習するVLA2024/5/1
言語注釈付きデモンストレーションを用いて、記号的な抽象行動空間と潜在状態抽象を自動獲得し、長期的な計画を可能にするフレームワークPARLを提案。