Google DeepMind en ICML 2024

Nuevos enfoques en IA generativa y multimodalidad

Las tecnologías de IA generativa y las capacidades multimodales están ampliando las posibilidades creativas de los medios digitales.

Presentaremos VideoPoet, que utiliza un LLM para generar video y audio de última generación a partir de entradas multimodales que incluyen imágenes, texto, audio y otros videos.

Y comparta Genie (entornos interactivos generativos), que puede generar una variedad de entornos jugables para entrenar agentes de IA, basados ​​en indicaciones de texto, imágenes, fotografías o bocetos.

Finalmente, presentamos MagicLens, un novedoso sistema de recuperación de imágenes que utiliza instrucciones de texto para recuperar imágenes con relaciones más ricas más allá de la similitud visual.

Apoyando a la comunidad de IA

Estamos orgullosos de patrocinar ICML y fomentar una comunidad diversa en IA y aprendizaje automático mediante el apoyo a iniciativas lideradas por Disability in AI, Queer in AI, LatinX in AI y Women in Machine Learning.

Si está en la conferencia, visite los stands de Google DeepMind y Google Research para conocer a nuestros equipos, ver demostraciones en vivo y obtener más información sobre nuestra investigación.