Yuxin Jiang
University of California, Los Angeles
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SUN: 言語に基づく制御から学習、実機への永続的プログラムマニピュレーション2026/8/31
モデルベース制御と学習ポリシーを橋渡しするため、幾何・接触関係を一度定義してMPCコストや報酬、遷移ガードなどにコンパイルする型付き実行可能プログラム「SUN」を導入し、大規模言語ビジョンモデルで自動合成するシステムKuafuを提案。デモなしで高成功率を達成した。
- RoboEdit: 人間の操作動画をスケーラブルなロボット経験へ変換するVLA2026/8/19
人間の操作動画を、ロボットの学習に使えるアクション整合性のある物理的に妥当なロボット動画へ変換するビデオ編集スイートを提案。大規模データセットと編集エンジンを構築し、実世界の操作タスクで有効性を実証した。
- FetchMan: シミュレーション経験から学ぶ視覚的ヒューマノイド移動操作ポリシー移動操作/sim2real2026/8/17
シミュレーションで合成デモをクローンするだけでは性能が頭打ちになることを発見し、強化学習とFlow-GRPOによる微調整を組み合わせたエンドツーエンドのsim-to-realパイプラインを構築。実機Unitree G1で未見シーンへのゼロショット到達・把持を73.3%の成功率で達成した。
- MemoryVAM: ロボット操作のためのビデオ行動モデルへの記憶統合VLA2026/6/1
ビデオワールドモデルポリシーにエピソード記憶機構を導入し、長期的な操作タスクで過去の情報を活用できるようにした。LIBERO-Memで成功率を5%から42.5%に向上させた。
- Olaf-World: 動画世界モデリングのための潜在行動の方向づけ世界モデル2026/2/10
ラベルなし動画から行動制御可能な世界モデルを学習するため、潜在行動を映像特徴の時間差分に整合させるSeqΔ-REPAを提案し、ゼロショット行動転移とデータ効率を改善した。
- Genie Envisioner:ロボット操作のための統合ワールド基盤プラットフォームVLA2025/8/1
指示条件付き動画拡散モデルを核に、方策学習・評価・シミュレーションを一つの動画生成フレームワークへ統合した基盤を提案し、軽量デコーダで行動軌跡を生成、専用ベンチマークも整備した。
- Genie Centurion:人間による巻き戻し・修正ガイダンスで実世界ロボット訓練を加速VLA2025/5/1
失敗時に状態を巻き戻して人間が修正デモを行い、1人の操作者が複数ロボットを監督できるデータ収集手法を提案し、従来法より成功率を最大40%向上させた。
- EnerVerse-AC: 行動条件付きで身体性環境を想像する世界モデル世界モデル2025/5/1
エージェントの予測行動から将来の視覚観測を生成する行動条件付き世界モデルを提案し、実機や複雑なシミュレーションなしでロボット模倣学習のデータ拡張と評価を可能にした。
- AgiBot World Colosseo:スケーラブルで知能的な身体性システムのための大規模マニピュレーションプラットフォームマニピュレーション2025/3/1
100万以上の軌道と217タスクを含む大規模ロボット操作データセットと、潜在行動表現を活用した汎用方策GO-1を提案し、データ規模の拡大に伴う性能向上と実世界での巧みな長期的タスクの成功率向上を示した。