Oren Gal
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MATES: 凍結した単一エージェント方策の観測変換によるマルチエージェント相互作用の学習マルチエージェント強化学習2026/9/22
マルチエージェント環境の観測を、凍結した単一エージェント方策が扱える形式に変換する小さなアダプタを学習することで、方策を再学習せずに協調行動を実現する手法。
- 一度のキャリブレーションでどんなチームでも飛行可能:残差補正に基づく低忠実度訓練による協調ドローン群制御群制御2026/9/15
高忠実度シミュレータでの強化学習を不要にし、低忠実度シミュレータを1機のキャリブレーション飛行で補正して、チーム規模に依存しない協調ドローン群ポリシーを訓練する手法を提案。
- 強化学習を用いた自律型水中ロボットのエンドツーエンドの動作計画と実行に向けて水中ロボット/強化学習2026/6/7
本論文は、生のセンサーデータからスラスター指令へのエンドツーエンドの深層強化学習アプローチを提案し、高レベル方策と低レベル方策を階層的に組み合わせて水中ロボットの障害物回避と目標到達を実現する。
- 動的流れにおけるマイクロ群ロコモーション最適化:多目的マルチエージェント強化学習を用いたアプローチ群制御2026/5/1
CFDと多目的マルチエージェント強化学習を組み合わせ、拍動流中のマイクロロボット群の制御ポリシーを学習し、上流進行・エネルギー効率・滑らかさを同時に最適化した。
- 遅延補償の分離:学習されたダイナミクスフィルタリングによる事前学習済みMARLポリシーの強化群制御2026/5/1
実世界のマルチエージェント強化学習では通信遅延やパケット損失が性能を劣化させるため、遅延した観測を現在の信念状態推定に置き換えるモジュール型の実行段階状態推定層を提案した。この層は事前学習済みポリシーにプラグインとして追加でき、元の学習アルゴリズムや報酬構造を変更せずに通信遅延やメッセージ損失に対するロバスト性を向上させる。
- 液体ニューラル軌道モデリングと協調型海洋ロボティクスによる自律的油流出対応群制御2025/8/1
Liquid Time-Constant Neural Networksとマルチエージェント群ロボティクスを組み合わせ、油流出の軌道をリアルタイム予測し自律的に追跡・対応する枠組みを提案した。
- AutoLoop: エージェント型カリキュラム学習による高速ビジュアルSLAMファインチューニングSLAM2025/1/1
DDPGエージェントでループ閉じ込みの重みを自動調整し、ビジュアルSLAMの学習を大幅に高速化する手法を提案。
- カリキュラム学習による堅牢な単眼視覚オドメトリ視覚オドメトリ2024/11/1
カリキュラム学習を単眼視覚オドメトリに導入し、難易度に応じた学習スケジュールでDPVOを強化して、複雑な環境でも高精度に自己位置推定できるようにした研究。
- 動的環境における目標追跡のための適応型USV群最適化群制御2024/8/1
無人水上艇(USV)の群れが複数目標を追跡する際に、適応型粒子群最適化とk近傍法(APSO-kNN)を用いて探索パターン(ランダムウォーク、スパイラル、芝刈り、クラスター探索)の性能を比較し、動的環境での追跡精度と効率を評価した研究。
- Learning to Explore Indoor Environments using Autonomous Micro Aerial Vehicles2023/9/1
- Agility and Target Distribution in the Dynamic Stochastic Traveling Salesman Problem2023/2/1
- Deep Learning on Home Drone: Searching for the Optimal Architecture2022/9/1
- Integrating Deep Reinforcement and Supervised Learning to Expedite Indoor Mapping2021/9/1