Moisés Martínez - Vision Language Model - DevFest Aranjuez 25
Los Vision-Language Models (VLMs) son un nuevo tipo de modelos de Inteligencia Artificial que combinan visión por computador y procesamiento del lenguaje natural. En esta charla analizaremos cómo estos modelos son capaces de entender y generar lenguaje natural a partir de imágenes, vídeos y otros datos visuales, permitiendo aplicaciones revolucionarias como asistentes visuales inteligentes, generación de descripciones automáticas y comprensión semántica de escenas.Para ello describiré los principios fundamentales detrás de su arquitectura y como utilizarlos para crear tus propias aplicaciones. ------- Síguenos en nuestras redes sociales Web: https://sirviendocodigo.com/ LinkedIn: https://www.linkedin.com/company/sirviendo-codigo/ X: https://twitter.com/sirviendocodigo Instagram: https://www.instagram.com/sirviendo.codigo/ TikTok: https://www.tiktok.com/@sirviendo.codigo #evangelio



