Farida Mohsen
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA人間-ロボット相互作用HRI意図予測強化学習/SNNセンサフュージョン
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Mambaベースの選択的状態空間モデリングがSmolVLA視覚言語行動エキスパートの精度-計算量トレードオフを改善VLA2026/8/10
VLAモデルの精度と計算量のトレードオフを改善するため、SmolVLAの行動エキスパートにMambaの選択的状態空間モデリングを適用し、LIBEROベンチマークで長い実行ホライズンでの成功率向上を実証した。
- RGB映像からの姿勢・感情手がかりを用いた実時間人間-ロボット相互作用意図検出とカメラ間モデル汎化人間-ロボット相互作用2025/12/1
単眼RGB映像から抽出した2D骨格姿勢と表情特徴を融合し、Raspberry Pi 5上で動作する実時間の人間-ロボット相互作用意図検出フレームワークを提案。MINT-RVAEによるデータ再均衡化と、異なるカメラ・環境下での高い汎化性能を実証した。
- MINT-RVAE:RGBカメラデータのみを用いた人間姿勢と感情情報による人とロボットのインタラクション意図のマルチキュー予測HRI意図予測2025/9/1
RGBカメラ映像のみから人間の姿勢と感情を手がかりに、ロボットとのインタラクション意図をフレーム単位で予測する手法を提案し、データセットのクラス不均衡に対処する合成系列生成と新損失関数でAUROC 0.95を達成した。
- スパイキングニューラルネットワークとメトロポリス・ヘイスティングスサンプリングによる動的エージェントの制御学習強化学習/SNN2025/7/1
勾配法を使わずメトロポリス・ヘイスティングスサンプリングでスパイキングニューラルネットワークを強化学習により訓練し、動的エージェント制御を実現するフレームワークを提案した。
- 超低解像度サーモカメラとジャイロの深層融合による照明に頑健で計算効率の良い回転オドメトリセンサフュージョン2025/6/1
超低解像度のサーモ画像とジャイロをCNNで融合し、照明条件に依存せずドリフトを抑えた回転速度推定を実現、省計算で小型ロボット向けの回転オドメトリを可能にした。