La mayoría de los agentes de IA lo olvidan. Procesan una solicitud, la responden y luego eliminan el contexto. El repositorio de IA generativa de Google Cloud ahora incluye una muestra que aborda esto directamente. Es el Agente de memoria siempre activo, una implementación de referencia que trata la memoria como un proceso en ejecución.
Agente de memoria siempre activo
Fundamentalmente, el proyecto es un agente en segundo plano ligero que nunca se detiene. Funciona las 24 horas del día, los 7 días de la semana como un proceso continuo, no como una llamada única. Está construido con Google ADK (Agent Development Kit) y Gemini 3.1 Flash-Lite. En particular, no utiliza ninguna base de datos vectorial ni incrustaciones. En cambio, un LLM lee, piensa y escribe memoria estructurada en SQLite. La elección del modelo apunta a una baja latencia y un bajo costo para el trabajo continuo en segundo plano.
Cómo funciona: ingesta, consolidación, consulta
Desde el punto de vista arquitectónico, un orquestador dirige cada solicitud a uno de los tres subagentes especializados. Cada subagente posee sus propias herramientas para leer o escribir el almacén de memoria.
Primero, IngestAgent maneja el contenido entrante. Utiliza las capacidades multimodales de Gemini para extraer un resumen, entidades, temas y una puntuación de importancia. Ese registro estructurado luego llega a la tabla de recuerdos.
A continuación, ConsolidateAgent se ejecuta con un temporizador, cada 30 minutos de forma predeterminada. Al igual que los ciclos del sueño, revisa los recuerdos no consolidados y encuentra conexiones entre ellos. Luego escribe un resumen sintetizado, una idea clave y esas conexiones a la base de datos. En consecuencia, el agente construye nuevos conocimientos mientras está inactivo, sin aviso.
Finalmente, QueryAgent responde preguntas. Lee todos los recuerdos y las ideas de consolidación y luego sintetiza una respuesta. Es importante destacar que cita los ID de memoria que utilizó como fuentes.