Ruipeng Zhang
収録論文 6本 ・ フィジカルAI/ロボット学習
モデルベース強化学習/OOD検出歩行軌道最適化強化学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 潜在モデリングのための感度整形モデルベース強化学習/OOD検出2026/6/1
学習したダイナミクスモデルが制御入力の変化に対して局所的に鈍感な場合、OOD検出が失敗する問題を指摘し、高サポート領域での制御感度を高める正則化を導入してOOD検出と安全な計画を改善した。
- 数秒のデモから学ぶ四足歩行歩行2026/3/7
四足歩行の模倣学習が少量データで効果的な理由を解析し、潜在空間と出力の変動を整える新手法を提案。数秒のデモからオフラインで歩行ポリシーを学習できることを実機で確認した。
- サンプリングベースのロバスト性解析を伴う時間最適四rotor軌道最適化のための系列モデリング軌道最適化2025/6/1
モデルベースの時間最適軌道計画を模倣する学習モデルを提案し、衝突のない幾何学的経路から時間最適軌道を高速生成。データ拡張でロバスト性を向上させ、実機でリアルタイム性を検証。
- 価値推定の改善がバニラ方策勾配法を大幅に強化する強化学習2025/5/1
各反復での価値更新ステップ数を増やすだけで、バニラ方策勾配法がPPOと同等以上の性能を達成し、ハイパーパラメータにも頑健になることを示した。
- 検索ベースの重み付き局所適応によるタスク非依存の生涯ロボット学習マニピュレーション2024/10/1
過去タスクのデータを一部保存し、経験再生と検索ベースの局所適応を組み合わせることで、タスクIDや境界が不明な環境でも破滅的忘却を抑えながら新しい操作タスクを継続学習する手法を提案した。
- Learning-based Motion Planning in Dynamic Environments Using GNNs and Temporal Encoding2022/10/1