Google AI presenta PaLI-3: un modelo de lenguaje de visión (VLM) más pequeño, más rápido y más potente que se compara favorablemente con modelos similares que son 10 veces más grandes
Vision Language Model (VLM) es un sistema avanzado de inteligencia artificial que combina la comprensión del lenguaje natural con capacidades de reconocimiento de imágenes. Al igual que CLIP de OpenAI…