Ge Yan
University of Washington
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Flex-π: 計算柔軟性を備えたマルチストリーム世界行動モデルVLA2026/8/1
既存の世界行動モデルはRGBのみを予測するが、Flex-πは凍結したビデオ生成VAEが3D点群も符号化できることを発見し、3D幾何学とオブジェクト中心のセマンティクスを追加で学習。ストリームごとのドロップアウトにより、単一のチェックポイントで高速な行動のみから完全な共同生成まで柔軟に動作し、実世界の両腕操作タスクで高い性能を達成。
- ManiFlow:一貫性フロー学習による汎用ロボットマニピュレーションポリシーマニピュレーション2025/9/1
視覚・言語・固有感覚入力を条件に、一貫性フロー学習で1〜2ステップの高精度なロボット動作生成を実現する汎用模倣学習ポリシーを提案。
- ヒューマノイド方策~ヒューマン方策VLA2025/3/1
一人称視点の人間の操作データをヒューマノイドロボットの学習に活用するため、人間とロボットの状態行動空間を統合したHuman Action Transformer (HAT)を提案し、汎化性能とロバスト性を向上させた。
- LMMプランナと3Dスキルポリシーの統合による汎用マニピュレーションマニピュレーション2025/1/1
大規模マルチモーダルモデルによる高レベル計画と3D特徴場を用いた低レベル制御を統合し、実環境のキッチンで長期的タスクの成功率を向上させたフレームワークLMM-3DPを提案。
- DNAct: 拡散モデル誘導によるマルチタスク3Dポリシー学習マニピュレーション2024/3/1
ニューラルレンダリングによる事前学習と拡散モデルによる訓練を組み合わせ、言語条件付きマルチタスク操作ポリシーを少ない実演から学習する手法を提案。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- GNFactor: Multi-Task Real Robot Learning with Generalizable Neural Feature Fields2023/8/1