Karl H. Johansson
KTH Royal Institute of Technology
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オフライン強化学習における拡散ポリシーのためのノイズ空間ポリシー勾配オフライン強化学習2026/9/7
拡散ポリシーを強化学習に統合するため、ノイズ空間で価値関数を定義し、クリーンな行動空間の価値推定のみを用いてノイズ潜在変数を最適化するポリシー勾配法を提案した。
- 損失と遅延のあるネットワークを用いたATMOSによる宇宙ロボット遠隔操作のデモンストレーション遠隔操作2026/8/14
この論文では、微小重力環境を模擬した平面型宇宙機アナログロボットATMOSを用いて、通信遅延がある状況での遠隔操作によるドッキング制御戦略を開発し、ソウルとストックホルム間の長距離実験で実証した。
- 強化学習による確率的多エージェントシステムの最適イベントトリガ分散制御群制御2026/7/20
強化学習を用いて、確率的な不確かさを持つ多エージェントシステムの最適分散制御アルゴリズムを提案し、アクター・クリティック・識別器構造とイベントトリガ制御で通信頻度を削減する。
- MetaKoopman: 分布シフト下での構造化ダイナミクスモデリングのためのコープマン作用素のベイズメタ学習メタ学習/ダイナミクスモデリング2026/7/1
コープマン作用素にベイズメタ学習を適用し、分布シフト下での非線形ダイナミクスを線形潜在表現でモデル化・予測する手法を提案。雪や氷などの厳しい条件下での自動運転トラック・トレーラー実験で有効性を実証した。
- モデルベース強化学習のためのアドバンテージ誘導拡散強化学習2026/4/10
拡散世界モデルを用いたモデルベース強化学習において、報酬ではなくアドバンテージ推定で逆拡散過程を誘導し、長期的なリターンが高い軌道を生成する手法を提案した。
- MeanFlowによる群れのサンプル値制御学習群制御2026/3/1
大規模な群れを限られた制御更新で誘導するための、サンプル値データ駆動学習フレームワークを提案。有限時間窓の制御量を学習し、橋渡し信号を用いた回帰で効率的に訓練する。
- 見通し外へ:視覚とV2X通信を活用した協調自己位置推定協調自己位置推定2025/7/1
車載カメラとV2X通信を用い、遮蔽物の多い交差点でも車両が自車位置・姿勢を推定できる分散型協調測位アルゴリズムを提案し、実機実験と大規模シミュレーションで検証した。
- 同種移動ロボットによる形状充填のための集中計画・分散実行手法群制御2025/3/1
機能が限られた移動ロボット群で複雑な形状を形成するため、形状が実現可能かを集中計画で判定し、隣接ロボットのみの情報で分散実行する手法を提案した。
- Transformerベースの行動クラスタリングとデータ駆動型到達可能性解析による歩行者運動予測歩行者予測2024/8/1
Transformerエンコーダと階層的密度クラスタリングで歩行者の多様な行動パターンを自動抽出し、データ駆動型到達可能性解析と組み合わせて将来の歩行軌道を予測する手法を提案した。
- 逆強化学習のための微分動的計画法フレームワーク逆強化学習2024/7/1
微分動的計画法(DDP)を用いて逆強化学習(IRL)を行い、コスト関数・システムダイナミクス・制約をデモンストレーションから復元するフレームワークを提案。開ループ損失関数に加え、閉ループ損失関数を導入し、理論的解析とロボット実験で有効性を示した。
- インテリジェント交差点の安全性保証:時相論理と到達可能性解析の融合自動運転/安全性検証2024/5/1
時相論理とハミルトン・ヤコビ到達可能性解析を組み合わせ、インテリジェント交差点を通過する車両の安全性を自動的に検証・保証するフレームワークを提案し、T字路のシミュレーションで有効性を示した。
- 時間論理木とHamilton-Jacobi到達可能性による複雑タスクの完了保証制御・形式手法2024/4/1
Hamilton-Jacobi到達可能性解析を用いた時間論理木により、サイバーフィジカルシステムが複雑なタスクを完了するための制御方策の存在確認と、リアルタイムで実行可能な制御入力集合の効率的な合成手法を提案した。
- Safe Reinforcement Learning using Data-Driven Predictive Control2022/11/1
- Multiagent Rollout with Reshuffling for Warehouse Robots Path Planning2022/11/1
- Safe Reinforcement Learning Using Black-Box Reachability Analysis2022/4/1
- Enhancing Data-Driven Reachability Analysis using Temporal Logic Side Information2021/9/1
- Navigating A Mobile Robot Using Switching Distributed Sensor Networks2021/6/1
- Learning Environment Constraints in Collaborative Robotics: A Decentralized Leader-Follower Approach2021/3/1
- Cooperative decentralized circumnavigation with application to algal bloom tracking2019/3/1