Jinyi Liu
収録論文 6本 ・ フィジカルAI/ロボット学習
強化学習マニピュレーションRLHF
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WarpSAC: 探索と活用の再考によるスケーラブルなオフ方策強化学習の頂点を目指して強化学習2026/8/25
データ量に応じて安定化手法を適応させるオフ方策RLアルゴリズムWarpSACを提案し、CPU/GPU並列環境で既存手法を大幅に上回る性能を達成した。
- 見ることから行うことへ:ロボットマニピュレーションのための推論と意思決定の橋渡しマニピュレーション2025/5/1
空間関係推論で中間表現を生成する視覚言語モデルFSDを提案し、ロボット操作のゼロショット性能を大幅に向上させた。
- マルチモーダル大規模言語モデルによるAIフィードバックでロボットマニピュレーションを強化マニピュレーション2024/2/1
マルチモーダルLLM「CriticGPT」を訓練し、画像入力のみから好みフィードバックを生成してロボットマニピュレーションの意思決定を導く手法を提案。Meta-Worldタスクで既存の事前学習表現モデルを上回る性能を示した。
- Uni-RLHF:多様な人間フィードバックを用いた強化学習のための汎用プラットフォームとベンチマークスイートRLHF2024/2/1
多様な人間フィードバックを扱うRLHFのための注釈プラットフォーム、大規模クラウドソーシングデータセット、モジュール式オフラインRLHFベースラインを提供する統合システムを構築し、30以上のタスクで1500万ステップを超えるデータを収集して評価した。
- ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles2023/6/1
- EUCLID: Towards Efficient Unsupervised Reinforcement Learning with Multi-choice Dynamics Model2022/10/1