Andrei-Carlo Papuc
収録論文 2本 ・ フィジカルAI/ロボット学習
長期計画群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- スキルレベル世界モデルの行動としてのフローポリシー:長期計画のための学習的・記号的抽象化長期計画2026/10/3
フローマッチングポリシーからスキルレベルの行動を構築し、記号ラベルや学習コードなどの抽象化を用いて世界モデル計画を行い、最大14スキルのブロック再配置タスクで評価した。
- スピードの駆け引き:学習型モデル予測ゲームによるマルチエージェントドローン競争群制御2026/2/1
ドローン競争において、相手の動きを考慮した戦略を高速に計算するため、モデル予測ゲームを学習で高速化するLMPGを提案し、シミュレーションと実機で既存手法を上回ることを示した。