Anujith Muraleedharan
収録論文 3本 ・ フィジカルAI/ロボット学習
ヒューマノイド動作生成マニピュレーションHuman-in-the-Loop強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhysMoDPO: 選好最適化による物理的に妥当なヒューマノイド動作生成ヒューマノイド動作生成2026/3/1
全身制御器(WBC)を訓練に組み込み、拡散モデルが生成する動作を物理法則とテキスト指示の両方に適合させる選好最適化フレームワークを提案し、シミュレーションと実機G1ヒューマノイドで有効性を示した。
- U-LAG: 不確実性を考慮した遅延適応型目標再設定によるロボットマニピュレーションマニピュレーション2025/10/1
知覚遅延やノイズがある環境で、物体の位置変化に応じて実行中に目標を再設定するモジュールU-LAGを提案し、ピック・プッシュ・積み重ね・ペグ挿入タスクで有効性を示した。
- 進捗に応じた選択的クエリで人間参加型強化学習を効率化Human-in-the-Loop強化学習2025/9/1
学習の停滞や悪化を検知したときだけ人間にフィードバックを求めるクエリ方策SPARQを提案し、常時フィードバックと同等の成功率を約半分のフィードバック量で達成した。