Yifan Zhai
収録論文 7本 ・ フィジカルAI/ロボット学習
継続学習ドローン/強化学習sim2realナビゲーションマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 変分的神経ダイナミクスによるロボットポリシーの継続学習継続学習2026/6/1
実世界の経験を活用して、隠れた繰り返し発生するダイナミクス下でロボットのポリシーを継続的に改善するフレームワークを提案。物理事前知識とニューラル残差を組み合わせ、オンラインで条件を推定してポリシーを適応させる。
- 投擲を学ぶ:クアッドローターによるケーブル吊り下げペイロードの機敏かつ正確な配送ドローン/強化学習2026/6/1
クアッドローターが吊り下げたペイロードを目標へ正確に投げる強化学習ポリシーを、高精度シミュレーションと実機で検証し、モデルベース手法より誤差と時間を大幅に削減した。
- ExT: 大規模マルチタスク事前学習とファインチューニングによるスケーラブルな自律掘削sim2real2025/9/1
大規模な実演データでマルチタスク掘削ポリシーを事前学習し、SFTやRLFTで微調整することで、シミュレーションから実機まで高精度な自律掘削を実現するフレームワークを提案。
- PA-MPPI: 未知環境におけるクアッドロータ航法のための知覚認識型モデル予測パス積分制御ナビゲーション2025/9/1
未知環境でクアッドロータが目標まで飛行する際、障害物で目標が見えないときは未知領域を観測できる経路を優先する知覚コストをMPPIに組み込み、地図を拡張しながら代替経路をオンライン計画する手法を提案。50Hzで動作することを実機実験で示した。
- オンザフライ学習:微分可能シミュレーションによる迅速な方策適応sim2real2025/8/1
微分可能シミュレーション内で残差ダイナミクス学習と実時間方策適応を統合し、実世界データでモデルを逐次更新することで、未見の外乱に5秒以内で適応するオンライン学習フレームワークを提案した。
- 大規模ロボットによる材料ハンドリング:学習・計画・制御マニピュレーション2025/8/1
油圧式マテリアルハンドラを用いた大規模バルク材料ハンドリングの自律実行フレームワークを提案し、強化学習による把持点計画と軌道追従制御を実装して実機検証した。
- Seeing All the Angles: Learning Multiview Manipulation Policies for Contact-Rich Tasks from Demonstrations2021/4/1