Felix Ocker
収録論文 7本 ・ フィジカルAI/ロボット学習
HRI/視覚言語モデル状況認識LLMエージェント人間ロボットインタラクション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MERGE: 人間とロボットの相互作用におけるマルチアクターイベント推論とグラウンディングのための誘導型視覚言語モデルHRI/視覚言語モデル2026/3/1
動的な人間とロボットのグループ相互作用において、アクター、物体、イベントを状況に応じてグラウンディングするシステムMERGEを提案。軽量な知覚パイプラインでVLMを選択的に呼び出し、効率と推論能力を両立し、新規データセットで性能を向上させた。
- CARMA: 視覚言語モデルと物体・行動認識を組み合わせた人間-ロボット群集団インタラクションの状況認識状況認識2025/6/1
複数人とロボットの協調作業において、視覚言語モデルと物体・行動認識を統合し、行為者・物体・行動の三つ組を生成することで状況認識を実現するシステムを提案。
- Tulip Agent:大規模ツールライブラリを活用するLLMエージェントLLMエージェント2024/7/1
LLMエージェントが大規模なツールライブラリを再帰的に検索してタスクを解決するアーキテクチャを提案し、数学とロボティクスで評価した。
- 助けるか助けないか:LLMに基づく人間とロボットのグループインタラクションへの注意深い支援人間ロボットインタラクション2024/3/1
LLMの常識推論を活用し、人間グループの状況を理解して必要な時だけ物理的支援を行うロボットの対話・行動生成手法を提案し、多様なシナリオで評価した。
- LaMI: Large Language Models for Multi-Modal Human-Robot Interaction2024/1/1
- Exploring Large Language Models as a Source of Common-Sense Knowledge for Robots2023/11/1
- CoPAL: Corrective Planning of Robot Actions with Large Language Models2023/10/1