La investigación de Google DeepMind permite a un LLM reescribir sus propios algoritmos de teoría de juegos, y superó a los expertos
El diseño de algoritmos para el aprendizaje por refuerzo de múltiples agentes (MARL) en juegos con información imperfecta (escenarios en los que los jugadores actúan secuencialmente y no pueden ver…