Minkyu Choi
収録論文 5本 ・ フィジカルAI/ロボット学習
ビデオ理解システム/プロファイリングVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CrossView: 視覚言語モデルはカメラをまたいで推論できるか?ビデオ理解2026/8/16
複数カメラ映像の質問応答ベンチマークCrossViewを新たに導入し、既存の視覚言語モデルが複数視点の統合推論に苦戦することを示した。
- PEERNet: ネットワーク接続型ロボットシステムのためのエンドツーエンド実時間プロファイリングツールシステム/プロファイリング2024/9/1
センサ・ネットワーク・深層学習パイプライン・デバイスを適応的にプロファイリングし、クラウドロボティクスの実時間性能を監視するツールPEERNetを提案。遠隔操作やVLM推論で非直感的な挙動を明らかにした。
- 基盤モデルによるロボットサブタスク分解のための時間的・意味的評価指標VLA2024/3/1
LLMとVLMを活用してロボット軌道データを時間区間付きの自然言語サブタスクに自動分解する枠組みを提案し、その品質を評価する時間類似度・意味類似度という新指標を導入した。
- Predictive Coding-based Deep Dynamic Neural Network for Visuomotor Learning2017/6/1
- Achieving Synergy in Cognitive Behavior of Humanoids via Deep Learning of Dynamic Visuo-Motor-Attentional Coordination2015/7/1