Jinkyoo Park
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- サンプルベース変分推論の償却による少数ステップ生成モデルのアライメント生成モデル/アライメント2026/5/26
生成器と参照分布へのサンプルアクセスのみで少数ステップ生成モデルを整列させる一般的な枠組みFAVを提案し、ロボット操作のポリシー整列と画像生成器の整列で有効性を示した。
- EvoNav: 大規模言語モデルを用いたロボットナビゲーションの進化的報酬関数設計ナビゲーション2026/5/1
ロボットナビゲーションの強化学習における報酬関数の設計を、大規模言語モデルと進化的アルゴリズムで自動化する手法を提案した論文。
- 動的屋内環境監視のためのマルチエージェント強化学習による協調的情報収集群制御2026/4/1
複数ロボットが屋内の人間活動を監視する際、監視精度を直接最適化する協調制御をマルチエージェント強化学習で学習する手法を提案した。
- 優先度を考慮したマルチロボット被覆経路計画群制御2026/1/1
優先区域を設定し、その被覆遅延と全体のメイクスパンを最小化するマルチロボット被覆経路計画問題を提案し、2段階のスケーラブルな解法を開発した。
- TrajEvo: LLM駆動進化による軌道予測ヒューリスティックの自動設計軌道予測2025/8/1
大規模言語モデルと進化アルゴリズムを組み合わせ、人間行動の軌道予測ヒューリスティックを自動生成・改良するフレームワークを提案。未見の分布外データでも既存手法を上回る汎化性能を示す。
- TrajEvo: LLM進化による軌道予測ヒューリスティックの自動設計軌道予測2025/5/1
大規模言語モデルと進化アルゴリズムを組み合わせ、過去の軌道データから軌道予測ヒューリスティックを自動生成・改良するフレームワークを提案し、未見データセットへの汎化性能で深層学習手法を上回った。
- USV群制御のための人間の暗黙的選好に基づくマルチエージェント強化学習のポリシー微調整群制御2025/3/1
USV群のマルチエージェント強化学習において、人間のフィードバックをエージェント単位で分類して信用割り当て問題を解決し、LLM評価器で検証するRLHF手法を提案した。
- ネットワーク化マルコフゲームにおけるミニマックス問題の分散オンライン計画群制御2024/5/1
ネットワーク化マルコフゲームにおいて、各エージェントが局所的なオンライン計画と分散最適化を組み合わせてミニマックス目的を近似するアルゴリズムを提案し、フォーメーション制御シミュレーションで有効性を示した。
- 優先度付きハイブリッド方策のアンサンブルによるマルチエージェント経路探索群制御2024/3/1
通信を用いたMARLベースのMAPFにおいて、選択的通信ブロックとQ学習、さらに推論時のハイブリッド専門家誘導・Q値優先競合解決・アンサンブルを組み合わせ、高障害密度環境での性能を向上させた手法EPHを提案。
- HiMAP: Learning Heuristics-Informed Policies for Large-Scale Multi-Agent Pathfinding2024/2/1
- Multi-Agent Dynamic Relational Reasoning for Social Robot Navigation2024/1/1
- Interactive Autonomous Navigation with Internal State Inference and Interactivity Estimation2023/11/1
- Robust Driving Policy Learning with Guided Meta Reinforcement Learning2023/7/1
- EvolveHypergraph: Group-Aware Dynamic Relational Reasoning for Trajectory Prediction2022/8/1
- Learning NP-Hard Multi-Agent Assignment Planning using GNN: Inference on a Random Graph and Provable Auction-Fitted Q-learning2019/5/1