◀ Back Vision-Language Model의 진화 (BLIP부터 Qwen까지) 멀티모달 비전-언어 모델(BLIP·Flamingo·LLaVA·MiniGPT-4·Qwen) 세미나 시리즈 총정리 July 21, 2026 · 김호기 교수 2026 · lab-seminar multi-modal vision-language-model image-to-text overview · multimodal