Mohsen Azarmi
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA運転者モニタリング歩行者意図予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語基盤モデルによる歩行者意図予測VLA2025/7/1
視覚言語基盤モデルと階層的プロンプトを用いて歩行者の横断意図を予測し、車速や時間情報の統合とプロンプト最適化により精度を最大19.8%向上させた研究。
- Driver-Net: 自動運転車における運転交代準備状態を評価するマルチカメラ融合運転者モニタリング2025/7/1
運転者の頭・手・体姿勢を3台のカメラで同期撮影し、時空間特徴を二経路アーキテクチャとクロスモーダル融合で統合して、自動運転からの運転交代準備状態を最大95.8%の精度で推定する手法を提案。
- 歩行者意図予測における特徴量重要度:文脈を考慮したレビュー歩行者意図予測2024/9/1
歩行者の横断意図予測モデルの解釈性を高めるため、シナリオ文脈ごとに特徴量重要度を評価するCAPFI手法を提案し、PIEデータセットで5つのモデルを比較した。