Kehan Wen
収録論文 7本 ・ フィジカルAI/ロボット学習
世界モデル操作学習/報酬設計歩行模倣学習VLAオフライン強化学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- XP-JEPA: 予測可能な潜在ダイナミクスのための交差予測物理基盤世界モデル2026/8/25
視覚と物理状態を別々に符号化し、共有予測器で両方を進めることで、物理遷移に基づく潜在ダイナミクスを学習する手法を提案。訓練後に物理ブランチを捨て、視覚のみで制御可能。
- RARM: 操作学習における信頼度ゲート付き進捗報酬モデリング操作学習/報酬設計2026/6/1
単一の成功デモ動画を参照し、ロボット操作の強化学習向けに信頼できる進捗報酬を生成する軽量な視覚比較モデルを提案した。
- モーション生成とモーショントラッキングによる全身ヒューマノイド歩行の学習歩行2026/4/1
参照モーションから学習した全身スキルと地形認識適応を組み合わせたヒューマノイド歩行フレームワークを提案し、実機で箱や階段などの複合地形を踏破できることを示した。
- 不完全なデモンストレーションからの制約付きスタイル学習:タスク最適性の下で模倣学習2025/7/1
ロボットのスタイル動作を不完全なデモから学ぶため、制約付きMDPとして定式化し、適応的ラグランジュ乗数でタスク性能を維持しつつスタイルを模倣する手法を提案。ANYmal-Dでエネルギー消費を14.5%削減。
- Mini Diffuser: 二段階ミニバッチによる高速マルチタスク拡散ポリシー学習VLA2025/5/1
拡散ポリシー学習において、視覚言語条件ごとに複数のノイズ付き行動サンプルを組み合わせる二段階ミニバッチを導入し、情報漏洩を防ぐアーキテクチャ改良により、性能を保ちつつ学習時間とメモリを大幅に削減した。
- M³PC:事前学習済みマスク付き軌道モデルのためのテスト時モデル予測制御オフライン強化学習2024/12/1
マスク付き自己符号化で事前学習した軌道モデルを、推論時にモデル予測制御(MPC)で活用し、追加学習なしで意思決定性能を向上させる手法を提案。
- DexDribbler: 動的監督による器用なサッカーマニピュレーションの学習マニピュレーション2024/3/1
脚ロボットが移動するボールを操作しながら走行するサッカー動作を、フィードバック制御による動的監督と改良されたボールモデル・推定器を用いてシミュレーションから実機へ転移学習する手法を提案。