Hassan Ali
収録論文 6本 ・ フィジカルAI/ロボット学習
HRI物体検出VLA意図予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 指差し誘導による対象推定:Transformerベースの注意機構を用いてHRI2025/9/1
人間の指差しジェスチャーからテーブル上の対象物を推定するため、モダリティ間注意機構を活用したモジュール型アーキテクチャMM-ITFを提案し、単眼RGB画像で高精度に対象を予測できることを示した。
- ロボット信頼性への相互作用中心アプローチに向けてHRI2025/8/1
人間とロボットの相互理解を通じて信頼を構築するための相互作用ベースの枠組みを提案し、人間の認識と透明性の2つの柱と4つの要素を導入する。
- 振っても混ぜるな:ヒューマンロボットバーテンディングにおけるグラスの視覚理解のための新規データセット物体検出2025/3/1
透明・反射するグラスの多様性に対応するため、RGB-Dセンサから自動ラベリングで収集した実世界グラスデータセットGlassNICOLDatasetを構築し、オープンボキャブラリ検出器を上回る性能とバーテンディングタスクでの81%の成功率を達成した。
- おしゃべりするロボット:マルチモーダルな人間-ロボット会話と協働の基盤構築VLA2024/7/1
LLMを中心に音声認識・音声生成・物体検出・姿勢推定・ジェスチャ検出を統合し、自然な人間-ロボット会話と協働を実現するモジュール型システムを提案した。
- ロボットもマルチタスクをこなせる:記憶アーキテクチャとLLMを統合したクロスタスク行動生成VLA2024/7/1
人間の認知に着想を得た二層の記憶モデルと2つのLLMを組み合わせ、ロボットが複数タスク間を切り替えながら適応的に行動を生成する手法を提案し、5つのタスクで性能向上を示した。
- リンゴとオレンジの比較:LLMを活用した物体分類タスクにおけるマルチモーダル意図予測意図予測2024/4/1
物体分類タスクで協働するロボットが、ユーザーのジェスチャー・姿勢・表情・発話・環境状態をLLMで統合し、意図を階層的に予測する手法を提案・評価した。