Yizhan Feng
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UAV映像理解のためのBLIP-2を用いたエッジ最適化マルチモーダル学習VLA2026/1/1
BLIP-2にYOLO-WorldとYOLOv8-Segを組み合わせ、キーフレーム選定とプロンプト最適化により、UAVのエッジ機器でも動作する軽量なマルチモーダル映像理解プラットフォームを提案した。
- 大規模言語モデルによるシミュレーション環境でのドローン multitask 操作の強化VLA2026/1/1
微調整したCodeT5とAirSimを組み合わせ、自然言語コマンドからドローン操作用コードを自動生成してマルチタスクを実行する手法を提案。