Modi Shi
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EgoHumanoid-V2: 全身協調ロコマニピュレーションのための人間からヒューマノイドへのスキル転移VLA2026/9/29
一人称視点の人間のデモデータから、全身協調を保ったままロコマニピュレーションスキルをヒューマノイドへ直接転移する枠組みを提案し、実機4タスクでゼロショット転移を実現した。
- UR-VC: 時間由来の進捗指標に対する教師なしロボット価値補正操作学習2026/7/1
デモンストレーションの時間正規化を進捗ラベルとして使う際のノイズを、他エピソードの類似状態から補正する教師なし・学習不要の手法を提案した。
- NativeMEM: 長期ホライズンのロボット操作のためのネイティブメモリ圧縮VLA/長期メモリ/操作2026/7/1
事前学習済みVLAモデルが高頻度更新で長い視覚履歴を保持できるように、VLA自身の視覚エンコーダを再利用して各フレームを単一トークンに圧縮するメモリ圧縮方式を提案。外部メモリや新規モジュール不要で、シミュレーション成功率を32.4%から84.0%に向上させた。
- Dexora: 高自由度両腕巧緻操作のためのオープンソースVLAVLA/操作2026/5/1
両腕・両手の高自由度操作を対象とした初のオープンソースVLAシステムDexoraを提案し、ハイブリッド遠隔操作とデータ品質を考慮した学習手法により、巧緻操作の成功率を大幅に向上させた。
- EgoHumanoid:ロボット不要の一人称デモで実世界ロコマニピュレーションを実現ロコマニピュレーション2026/2/1
人間の一人称視点デモと少量のロボットデータを共訓練し、視点・動作のずれを補正することで、ヒューマノイドの実世界ロコマニピュレーション性能を51%向上させた。
- χ₀: 分布の不一致を抑え込むリソース効率の良いロバストマニピュレーションマニピュレーション2026/2/1
人間のデモ分布・方策の帰納バイアス・実行時分布のずれを、重み空間マージやステージ適応型アドバンテージ推定、訓練-展開アライメントで解消し、限られた計算資源で双腕ロボットによる衣類の長期的操作を高信頼に実現した。
- WholeBodyVLA:全身移動操作のための統合潜在VLAVLA2025/12/1
低コストな自己視点動画から移動操作知識を学ぶ統合潜在VLAと、精密な移動指令を実行するRLポリシーを組み合わせ、ヒューマノイドの広域移動操作を実現した。
- EO-1: 汎用ロボット制御のためのオープンな統合身体性基盤モデルVLA2025/8/1
視覚・言語・行動を統合的に扱う基盤モデルEO-1と150万件のデータセットEO-Data1.5Mを提案し、多様なロボットでの長期的な器用マニピュレーションを実現した。
- スケーラブルなロボットマニピュレーションに多様性は本当に必要か?マニピュレーション2025/7/1
ロボット学習におけるデータ多様性の役割をタスク・身体・専門家の3次元で検証し、タスク多様性が重要である一方、専門家の速度多様性は学習を妨げることを示し、その偏りを補正する手法を提案した。
- Genie Centurion:人間による巻き戻し・修正ガイダンスで実世界ロボット訓練を加速VLA2025/5/1
失敗時に状態を巻き戻して人間が修正デモを行い、1人の操作者が複数ロボットを監督できるデータ収集手法を提案し、従来法より成功率を最大40%向上させた。
- Hume:視覚-言語-行動モデルにシステム2思考を導入VLA2025/5/1
価値誘導型の熟考(システム2)と軽量な反応型ポリシー(システム1)を組み合わせた二重システムVLAモデルを提案し、器用なロボット制御を実現した。
- AgiBot World Colosseo:スケーラブルで知能的な身体性システムのための大規模マニピュレーションプラットフォームマニピュレーション2025/3/1
100万以上の軌道と217タスクを含む大規模ロボット操作データセットと、潜在行動表現を活用した汎用方策GO-1を提案し、データ規模の拡大に伴う性能向上と実世界での巧みな長期的タスクの成功率向上を示した。
- ドメイン事前知識による6自由度把持検出の汎化マニピュレーション2024/4/1
ロボット把持の物理的制約を正則化として学習に組み込み、接触スコアと投影接触マップで把持姿勢を補正することで、未知物体への6自由度把持検出の汎化性能を向上させた。