Yuzhi Lai
収録論文 6本 ・ フィジカルAI/ロボット学習
視線操作人機協調AR/拡張現実HRI人間-ロボットインタラクション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 物体選択を超えて:マーカーレス視線による任意位置へのロボット配置視線操作2026/8/31
視線ベースの支援操作で、物体選択だけでなく任意位置への配置を可能にするマーカーレスフレームワークを提案し、タスク指向の評価指標GSIEを導入した。
- Glance-Say: 視線と音声によるマルチモーダルな人機協調と意図認識人機協調2026/3/1
視線と音声を組み合わせた支援ロボット操作のためのインタラクションフレームワークを提案し、視線の揺れや意味の曖昧さに頑健な意図認識を実現した。
- SEER-VAR: 車載ARのための自己中心環境セマンティック推論フレームワークAR/拡張現実2025/8/1
車内と道路のシーンを深度誘導の視覚言語グラウンディングで分離し、2つのSLAMブランチで自己中心運動を追跡、GPTベースのモジュールが危険警告などのARオーバーレイを生成する車載ARフレームワークを提案。
- FAM-HRI: 基盤モデルを活用した視線と音声のマルチモーダル人間-ロボットインタラクションHRI2025/3/1
ARグラスで視線と音声を取得し、LLMで意図とシーン文脈を統合することで、身体障害のあるユーザーでも直感的にロボットを操作できるマルチモーダルHRIフレームワークを提案した。
- NVP-HRI: 大規模言語モデルを活用したゼロショット自然音声・姿勢ベースの人間-ロボットインタラクションHRI2025/3/1
音声指示と指差し姿勢を組み合わせ、SAMとLLMを用いて未知物体をゼロショットで認識し、衝突回避軌道を生成するHRIシステムを提案。
- 音声と指示姿勢の自然なマルチモーダル融合による人間-ロボットインタラクション:大規模言語モデルを用いた応用人間-ロボットインタラクション2025/1/1
音声と指示姿勢を組み合わせ、大規模言語モデルでロボット動作を生成する自然な人間-ロボットインタラクションシステムを提案し、UR3eマニピュレータで有効性を示した。