Jingrui Pang
収録論文 8本 ・ フィジカルAI/ロボット学習
マニピュレーション操作VLA/安全性評価VLA/操作VLA/世界モデルVLA/基盤モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Motus2: 巧みな操作のための自己進化型汎用世界モデルマニピュレーション2026/8/31
Motus2は、ポリシー・シミュレータ・評価器を統合した自己進化型の世界モデルで、巧みな操作を実現する。モデルとデータのスケーリングにより、意思決定と学習の閉ループを形成する。
- HiMem-WAM: ロボット操作のための階層的メモリゲート型ワールドアクションモデル操作2026/6/1
長期的なロボット操作タスクにおける記憶保持の問題を解決するため、階層的な潜在アクションと境界トリガー型メモリ更新を統合したワールドアクションモデルを提案した。
- LIBERO-Safety: 視覚言語行動モデルにおける物理的・意味的安全性の包括的ベンチマークVLA/安全性評価2026/6/1
VLAモデルの安全性を評価するため、パラメトリックな安全ベンチマークと大規模データセットを構築し、8つのVLAモデルと2つの基盤モデルの系統的評価を行った。
- Dexora: 高自由度両腕巧緻操作のためのオープンソースVLAVLA/操作2026/5/1
両腕・両手の高自由度操作を対象とした初のオープンソースVLAシステムDexoraを提案し、ハイブリッド遠隔操作とデータ品質を考慮した学習手法により、巧緻操作の成功率を大幅に向上させた。
- Motubrain: ロボット制御のための高度な世界行動モデルVLA/世界モデル2026/4/1
視覚・言語・行動を統合した世界行動モデルMotubrainを提案し、動画と行動の同時予測や多様なロボットデータへの対応、高速な実時間推論を実現した。
- XEmbodied: 大規模具現環境向けに幾何・物理的手がかりを強化した基盤モデルVLA/基盤モデル2026/4/1
クラウド側でVLMに3次元幾何認識と物理的手がかりを統合し、空間推論や具現化タスクの性能を向上させる基盤モデルを提案した。
- AtomVLA: 予測的潜在世界モデルによるロボット操作のためのスケーラブルなポストトレーニングVLA/操作2026/3/1
VLAモデルの長期的なタスク実行における指示の粒度不足による誤差蓄積を解決するため、大規模言語モデルでタスクを細分化し、予測的世界モデルで潜在空間内のサブタスク達成度を評価する新しいフレームワークを提案した。
- RoboCOIN: 統合マニピュレーションのためのオープンソース両腕ロボットデータ収集マニピュレーション2025/11/1
15種類のロボットプラットフォームから18万件以上の両腕操作デモを集めた大規模データセットを構築し、階層的な注釈とデータ処理パイプラインを提供した。