Sandhya Saisubramanian
収録論文 6本 ・ フィジカルAI/ロボット学習
プランニング/行動モデル学習群制御多目的計画人間フィードバック学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 不確実性誘導探索による条件付き・量化効果を持つ行動モデルの学習プランニング/行動モデル学習2026/8/31
限られた環境との相互作用から、条件付き効果や量化効果を含む行動モデルをオンラインで学習する手法OHCAMを提案。仮説間の不一致を最大化する行動選択で不確実性を減らし、ノイズに頑健で、実ロボットでも有効性を確認した。
- 文脈不確実性下でのマルチロボット協調計画群制御2026/3/1
未知の文脈に依存する目的を持つ環境で、ロボット群が協調して文脈を推定し、その後のタスクを効率的に遂行するための2段階アルゴリズムを提案した。
- 文脈依存の辞書式報酬選好に基づく多目的計画多目的計画2025/2/1
文脈ごとに目的の優先順位が変わる状況で、専門家の軌跡から状態と文脈の対応をベイズ推定し、各順序の政策を統合して巡回のない政策を計画する枠組みを提案した。
- 人間フィードバックからの報酬学習のための適応的クエリ人間フィードバック学習2024/12/1
不安全行動に対するペナルティ関数を、複数形式の人間フィードバックから効率的に学習するため、クエリ状態とフィードバック形式を情報利得に基づいて適応的に選択する手法を提案した。
- 責任割り当てによるマルチエージェントシステムの副作用軽減群制御2024/5/1
協調型マルチエージェント系で生じる意図しない副作用を、クレジット割り当てで各ロボットの個別ペナルティに分解し、分散方策計算で軽減する手法を提案した。
- Mitigating Negative Side Effects via Environment Shaping2021/2/1