Boyi Ma
収録論文 2本 ・ フィジカルAI/ロボット学習
マルチモーダル認識VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 敵対的特徴分離による頑健な手術ワークフロー認識のためのマルチモーダルグラフ表現学習マルチモーダル認識2025/5/1
視覚と運動学データをグラフ表現で統合し、敵対的特徴分離でモダリティ間のギャップを埋めることで、データ破損やドメインシフトに頑健な手術ワークフロー認識手法を提案した。
- DeepSeekは外科医のように推論できるか?ロボット支援手術における視覚言語理解の実証評価VLA2025/3/1
DeepSeekモデルをロボット手術の視覚言語タスク(単語QA・視覚QA・詳細記述)で評価し、汎用マルチモーダルモデルより優れるが臨床要件には未達であることを示した実証研究。