Toshitaka Matuki
収録論文 1本 ・ フィジカルAI/ロボット学習
歩行
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 歩行ポリシーにおける潜在フェーズ構造の可視化:時間的特徴拡張を用いたマルチ環境研究歩行2026/5/1
深層強化学習で訓練された歩行制御ポリシーが内部に獲得する運動フェーズ構造を、行動や次の状態・行動を含む特徴量の拡張とクラスタリングにより可視化する手法を提案し、複数の環境で既存手法より明確なフェーズ遷移を確認した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
深層強化学習で訓練された歩行制御ポリシーが内部に獲得する運動フェーズ構造を、行動や次の状態・行動を含む特徴量の拡張とクラスタリングにより可視化する手法を提案し、複数の環境で既存手法より明確なフェーズ遷移を確認した。