Daisuke Yasui
収録論文 2本 ・ フィジカルAI/ロボット学習
歩行歩行制御/解釈可能性
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 歩行ポリシーにおける潜在フェーズ構造の可視化:時間的特徴拡張を用いたマルチ環境研究歩行2026/5/1
深層強化学習で訓練された歩行制御ポリシーが内部に獲得する運動フェーズ構造を、行動や次の状態・行動を含む特徴量の拡張とクラスタリングにより可視化する手法を提案し、複数の環境で既存手法より明確なフェーズ遷移を確認した。
- 歩行ポリシーにおける潜在的な位相構造と分岐ロジックの解明:HalfCheetahを対象としたケーススタディ歩行制御/解釈可能性2026/3/1
深層強化学習で学習された歩行制御ポリシーの内部状態遷移を、状態類似性と遷移の一貫性に基づいて意味的な位相に集約し、周期構造と分岐が存在することを実証した。さらに、各位相の意思決定を説明可能なブースティングマシンで近似し、ポリシーが注目する状態特徴と行動出力の制御を解析した。