Nuevos enfoques en IA generativa y multimodalidad
Las tecnologías de IA generativa y las capacidades multimodales están ampliando las posibilidades creativas de los medios digitales.
Presentaremos VideoPoet, que utiliza un LLM para generar video y audio de última generación a partir de entradas multimodales que incluyen imágenes, texto, audio y otros videos.
Y comparta Genie (entornos interactivos generativos), que puede generar una variedad de entornos jugables para entrenar agentes de IA, basados en indicaciones de texto, imágenes, fotografías o bocetos.
Finalmente, presentamos MagicLens, un novedoso sistema de recuperación de imágenes que utiliza instrucciones de texto para recuperar imágenes con relaciones más ricas más allá de la similitud visual.
Apoyando a la comunidad de IA
Estamos orgullosos de patrocinar ICML y fomentar una comunidad diversa en IA y aprendizaje automático mediante el apoyo a iniciativas lideradas por Disability in AI, Queer in AI, LatinX in AI y Women in Machine Learning.
Si está en la conferencia, visite los stands de Google DeepMind y Google Research para conocer a nuestros equipos, ver demostraciones en vivo y obtener más información sobre nuestra investigación.