Hamed Rahimi
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーションVLAHRI対話エージェント
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 必要なときに考える:RLポリシーを用いた社会的ナビゲーションのための条件付きVLM推論ナビゲーション2026/7/1
ロボットの社会的ナビゲーションにおいて、RLポリシーの高速性とVLMの意味理解を動的に切り替えるハイブリッドアーキテクチャHUMAを提案し、ベンチマークで性能向上を実証した。
- スタイル条件付き拡散ポリシーによる予測可能性と可読性のエンコードVLA2026/3/1
事前学習済み拡散ポリシーを凍結し、軽量なシーンエンコーダと条件予測器で軌道生成を可読性か効率性に制御するモジュール型フレームワークを提案。曖昧な状況では可読性を高め、不要な時は効率を保つ。
- HARMONI: LLMを用いたマルチユーザーヒューマンロボットインタラクションのマルチモーダル個別化HRI2026/1/1
大規模言語モデルを活用し、社会的支援ロボットが複数ユーザーとの長期的な対話を持続的に個別化・適応させるマルチモーダルフレームワークを提案。介護施設での実証実験を含む評価で、話者識別や記憶更新、倫理的に整合した個別化を実現した。
- I-FailSense: 視覚言語モデルによる汎用的なロボット失敗検出に向けてVLA2025/9/1
視覚言語モデルを微調整し、内部層に軽量な分類ヘッドを付けてアンサンブルすることで、指示と意味的にずれたロボットの失敗を検出するフレームワークを提案。
- ユーザー認識型マルチモーダル対話エージェントのための推論LLM対話エージェント2025/4/1
CoT推論とVLMを組み合わせ、初対面から動的にユーザープロファイルを推定・更新するパーソナライズ対話フレームワークを提案し、高齢者向けVQAベンチマークで性能向上を示した。
- User-VLM 360°: 社会的ヒューマンロボットインタラクションのためのユーザー認識チューニングによる個人適応型視覚言語モデルVLA2025/2/1
ユーザーの視覚・言語信号に基づきリアルタイムで適応する個人化視覚言語モデルを提案し、バイアス軽減と社会的感情データセットを統合してPepperロボットで実証した。