Jiahui Zhang
収録論文 18本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 観測ゲートフィルタを用いた自律能動マッピングにおける学習占有度の再考能動マッピング2026/9/8
自律3D能動マッピングにおいて、学習された占有度予測がプランナーに与える影響を閉ループベンチマークで分析し、観測ゲートフィルタを導入して未観測領域の補完を保持しつつ、繰り返し観測された領域の誤予測を抑制する手法を提案した。
- 能動マッピングのための占有ワールドモデルの診断と動的フィルタリング能動マッピング2026/9/6
能動マッピングにおける占有ネットワークの誤りが計画に与える影響を診断し、オンライン観測に基づいて誤った占有予測を動的に抑制するフィルタリング手法を提案した。
- MILD: 変形可能な地形上での二足歩行学習のための扱いやすい地形モデリング歩行2026/8/20
変形する地面での二足歩行を可能にするため、物理に基づく離散要素接触ソルバーと深層強化学習による地形認識コントローラを提案し、実機で適応を実証した。
- 狭い空間を跳び越える四足ロボットの高ダイナミックスキル遷移学習階層型強化学習/四足歩行2026/8/20
四足ロボットが狭いゲートを動的に通過するための階層型強化学習パイプラインを提案。低レベル方策は模倣学習で動物の多様なスキルを獲得し、高レベル制御が視覚情報とスキル能力を考慮して衝突回避軌道を選択する。
- 行動から世界モデリングへの転移可能なダイナミクス事前学習世界モデル/事前学習2026/6/1
ロボット操作データを用いて行動条件付きの世界モデルを事前学習し、そのダイナミクス事前知識をシミュレータとポリシー学習の両方に転移させる手法を提案した。
- 想像された未来から実行可能な行動へ:ロボット操作のための潜在行動の混合マニピュレーション2026/5/1
ビデオ生成モデルによる未来予測をロボット操作に活用する際、予測フレームを直接ポリシーに渡すのではなく、複数の逆動力学モデルを用いて潜在行動の混合表現に変換する制御指向インターフェースMoLAを提案し、シミュレーションと実機で性能向上を確認した。
- VLA-REPLICA: 実世界での視覚言語行動モデル評価のための低コストで再現可能なベンチマークVLA/ベンチマーク2026/5/1
低コストで再現可能な実世界ベンチマークを提案し、VLAモデルの評価を標準化する。
- Robometer:軌道比較による汎用ロボット報酬モデルのスケーリング報酬モデリング2026/3/1
軌道内の進捗監督と軌道間の選好監督を組み合わせた報酬モデルを提案し、100万軌道のデータセットで学習することで、汎用性の高い報酬関数を実現した。
- Co-jump: 四足歩行ロボットのマルチエージェント強化学習による協調ジャンプマルチエージェント強化学習2026/2/1
2台の四足歩行ロボットが通信なしに同期して、単体では不可能な高さのジャンプを実現する協調制御を、マルチエージェント強化学習とカリキュラム学習で獲得した。
- ヒューマノイドロボットのための人間らしいバドミントンスキルの学習sim2real2026/2/1
人間の動作データを強化学習で蒸留し、バドミントンのリフトやドロップショットなどのスキルをヒューマノイドロボットにゼロショットでsim-to-real転移させた研究。
- 予言による行動方策の強化学習VLA2025/11/1
ロボット世界モデル「Prophet」を大規模データで事前学習し、新環境へ少数適応させてシミュレータとし、FlowScaleでVLA方策を強化学習する手法を提案。
- FR-Net: 質量接触予測による難地形でのロバストな四脚ロボットの転倒復帰学習転倒復帰2025/9/1
限られたセンサ入力から質量分布と接触状態を予測するネットワークを中核に、シミュレーションでの特権学習を通じて、様々な地形で任意の転倒姿勢から四脚ロボットが安全に復帰する方策を学習するフレームワークを提案。
- ReWiND: 言語ガイド報酬で新規デモなしにロボット方策を教えるVLA2025/5/1
言語指示から報酬関数を学習し、オフラインRLで事前学習した方策を新規タスクに少ない試行で適応させるフレームワークを提案。
- 複雑地形における四足歩行ロボットの適応的転倒復帰コントローラの学習歩行2024/12/1
深層強化学習を用いて、岩場や急斜面などの複雑地形で四足歩行ロボットが転倒から復帰できる適応的コントローラを訓練し、実機への転移とシミュレーションで有効性を検証した。
- Bootstrap Your Own Skills: Learning to Solve New Tasks with Large Language Model Guidance2023/10/1
- SPRINT: Scalable Policy Pre-Training via Language Instruction Relabeling2023/6/1
- An Intelligent Self-driving Truck System For Highway Transportation2021/12/1
- Compact 3D Map-Based Monocular Localization Using Semantic Edge Alignment2021/3/1