Carlo R. daCunha
収録論文 1本 ・ フィジカルAI/ロボット学習
群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 局所学習を不安定化させないロボットポリシー精錬のためのスキーマ拘束型言語モデル群制御2026/9/4
異種ロボット群の分散ナビゲーションにおいて、LLMによるポリシー生成をラウンド単位に限定し、UCBバンディットとDouble DQNで局所制御を安定化させる手法を提案・評価した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
異種ロボット群の分散ナビゲーションにおいて、LLMによるポリシー生成をラウンド単位に限定し、UCBバンディットとDouble DQNで局所制御を安定化させる手法を提案・評価した。