Jiange Yang
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 部分観測下のロボットマニピュレーションにおけるスキルレベル記憶のベンチマークと強化マニピュレーション2026/9/30
部分観測下での操作記憶を評価するベンチマークHIDEを提案し、履歴保持と実行状態追跡のための記憶機構SEEKを開発した。既存方策の限界を示し、記憶拡張がシミュレーションと実世界で成功率を向上させることを示した。
- 自己回帰離散事前学習による身体性VLM推論とロボット行動の統合VLA2025/12/1
身体性推論を評価するベンチマークERIQと、連続制御を離散化するFACTトークナイザを提案し、推論と行動を統合したGenieReasonerで実世界マニピュレーション性能を向上させた。
- StaMo: コンパクトな状態表現による汎化可能なロボット動作の教師なし学習VLA2025/10/1
軽量エンコーダと事前学習済みDiTデコーダで2トークンの圧縮状態表現を教師なし学習し、その差分が潜在行動として機能することを発見。VLAモデルに統合してLIBEROで14.3%、実世界で30%の性能向上を達成。
- プリミティブ身体性ワールドモデルの学習:スケーラブルなロボット学習に向けてワールドモデル2025/8/1
動画生成ベースの身体性ワールドモデルを固定短時間のプリミティブ動作に限定し、言語と動作の細粒度対応・データ効率・推論速度を改善するPEWMを提案。VLMプランナとヒートマップ誘導で閉ループ制御と長期タスクへの組合せ汎化を実現する。
- VQ-VLA:ベクトル量子化アクショントークナイザのスケーリングによる視覚-言語-行動モデルの改善VLA2025/7/1
大規模な行動軌跡データセットで学習したベクトル量子化アクショントークナイザを提案し、ゼロショットで多様なロボットタスクに適応可能で、長期的タスクの成功率を最大30%向上させた。
- CoMo: インターネット動画から連続潜在運動を学習するスケーラブルなロボット学習VLA2025/5/1
インターネット動画から連続的な潜在運動表現を教師なしで学習し、未知動画へのゼロショット汎化と擬似行動ラベル生成を可能にする手法CoMoを提案。
- Tra-MoE: 複数ドメインからの軌道予測モデル学習による適応的ポリシー条件付けVLA2024/11/1
スパースMoEアーキテクチャで任意点軌道を予測し、適応的ポリシー条件付けでロボット制御を改善する手法を提案。
- SPA: 3D空間認識による効果的な身体性表現学習身体性表現学習2024/10/1
多視点画像への微分可能レンダリングでViTに3D空間理解を持たせ、8シミュレータ268タスクで既存手法を上回る身体性表現学習フレームワークを提案。
- ロボット運動制御のための時空間予測事前学習VLA2024/3/1
大規模動画を用い、マスクされた現在フレームの空間予測と未来フレームを条件とした時間予測を二重デコーダで同時に行うことで、運動情報を捉えるロボット運動制御向け視覚事前学習フレームワークSTPを提案した。
- Transferring Foundation Models for Generalizable Robotic Manipulation2023/6/1
- AlphaBlock: Embodied Finetuning for Vision-Language Reasoning in Robot Manipulation2023/5/1