Shuhe Huang
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションロボットポリシー評価VLA/世界モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Motus2: 巧みな操作のための自己進化型汎用世界モデルマニピュレーション2026/8/31
Motus2は、ポリシー・シミュレータ・評価器を統合した自己進化型の世界モデルで、巧みな操作を実現する。モデルとデータのスケーリングにより、意思決定と学習の閉ループを形成する。
- XPolicyLab: ロボットポリシー評価と展開のための統一標準・オープンエコシステムロボットポリシー評価2026/8/1
ロボットポリシーの評価と展開を統一する標準規格とオープンエコシステムを提案し、N個のポリシーとM個の環境の接続コストをO(NM)からO(N+M)に削減した。
- Motubrain: ロボット制御のための高度な世界行動モデルVLA/世界モデル2026/4/1
視覚・言語・行動を統合した世界行動モデルMotubrainを提案し、動画と行動の同時予測や多様なロボットデータへの対応、高速な実時間推論を実現した。
- Motus: 統合潜在行動ワールドモデルVLA2025/12/1
理解・映像生成・行動の3エキスパートをMixture-of-Transformerで統合し、光流から潜在行動を学習する統一ワールドモデルを提案。シミュレーションと実世界で既存手法を上回る性能を示した。
- Vidarc: 閉ループ制御のための身体性ビデオ拡散モデルVLA2025/12/1
マスク付き逆動力学モデルを組み合わせた自己回帰的な身体性ビデオ拡散モデルにより、低遅延で高精度なロボットアームの閉ループ制御を実現した研究。
- Vidar: 汎用マニピュレーションのための身体性ビデオ拡散モデルマニピュレーション2025/7/1
インターネット規模で事前学習したビデオ拡散モデルを実機ロボットの軌道で追加学習し、マスク付き逆動力学モデルで適応させることで、未知のロボットでも20分の実演だけで新タスクや背景・視点変化に汎化する手法を提案。
- AnyPos: 双腕マニピュレーションのためのタスク非依存動作の自動生成マニピュレーション2025/7/1
タスクに依存しない動作データを大規模に自動収集し、逆動力学学習で身体ダイナミクスをモデル化することで、様々なタスクやプラットフォームに転用可能な双腕マニピュレーション基盤を構築した研究。