Ruben Hernandez
収録論文 4本 ・ フィジカルAI/ロボット学習
プランニングナビゲーション軌道生成/拡散モデル/高速化強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットはいつ再計画すべきか?時間変動MDPにおける後悔に基づく更新スケジューリングプランニング2026/6/15
非定常環境で動作するロボットが、限られた計算予算の中でいつ再計画すべきかを、後悔(リグレット)理論に基づいて決定する手法を提案した論文。
- 信頼性のあるナビゲーションのためのタスク認識環境拡張:遮蔽付き条件付き拡散モデルナビゲーション2026/6/1
部分観測下での軌道計画の信頼性を高めるため、環境に視覚マーカーを配置する問題を扱い、条件付き拡散モデルを用いてマーカー配置を生成する手法を提案した。
- Muninn: あなたの軌道拡散モデルをより速く軌道生成/拡散モデル/高速化2026/5/1
拡散ベースの軌道プランナーを再学習なしで高速化するラッパー手法を提案。各ステップでキャッシュ再利用と再計算を適応的に切り替え、最大4.6倍の高速化を実現。
- 断続的観測下における欺瞞的政策のオンライン学習強化学習2025/9/1
監視が時々しか行われない状況で、観測時に監督者の期待に沿うように振る舞いつつ私的目的を達成する欺瞞的行動を、心の理論を活用したオンライン強化学習で獲得する手法を提案し、船舶・ドローンの実験で有効性を示した。