Memoria de un agente: capas orgánicas concéntricas con trazas

La memoria de un agente empresarial: qué debe recordar una IA

Un agente que no recuerda empieza de cero en cada conversación: no sabe
qué se decidió ayer, qué pasó con el cliente la semana pasada, ni cómo se
resuelve este tipo de tarea en esta empresa. La memoria no es un extra:
es lo que separa un sistema operativo de un oráculo amnésico.

Introducción

Ayer fijamos la distinción que nos ha acompañado: el RAG recupera lo que
está escrito, pero un agente que decide también necesita saber lo que ha
pasado. Hoy le damos nombre a esa capacidad: memoria. Y lo hacemos con
un marco preciso, porque «la memoria del agente» es una de las frases más
usadas y peor definidas de la IA empresarial.

El problema

Una empresa industrial opera con un agente de mantenimiento que asesora a
los técnicos sobre equipos críticos. El agente tiene un RAG sobre todos los
manuales y responde bien a preguntas de procedimiento. Pero los técnicos
empezaron a dejar de usarlo, y las quejas son reveladoras:

  • «Le pregunté ayer por qué la bomba B-7 vibraba y me dio tres causas
    posibles. Hoy le pregunté si ya se había descartado la alineación y me
    dijo que no tenía ese dato. No recuerda que le respondí anoche que la
    alineación estaba verificada.»
  • «Le pregunté cómo se resuelve un cambio de rodamiento y me dio el
    procedimiento genérico del manual. No sabe que en esta planta usamos un
    procedimiento modificado aprobado por calidad, porque solo está en un
    email de 2024.»
  • «Cada semana me repite las mismas tres causas para cada bomba. No
    aprende que en esta línea la vibración casi siempre viene del acoplamiento
    roto.»

Tres quejas, tres fallos distintos, y las tres tienen el mismo nombre:
el agente no tiene memoria de nada. No recuerda la conversación (lo que
pasó), no recuerda el conocimiento local (lo que se sabe aquí que no está en
el manual) y no recuerda cómo se hacen las cosas (el procedimiento real,
no el del papel).

El concepto

La literatura reciente de agentes (en particular el marco CoALA, de
Sumers et al., 2023) distingue cuatro tipos de memoria, tomados de la
ciencia cognitiva, que son exactamente los que un agente empresarial
necesita. A ellos añadimos una quinta, específica de la empresa.

  1. Memoria de trabajo (working / in-context). La información de la
    tarea actual: la conversación en curso, el estado del plan, los datos
    que se están manipulando. Es la ventana de contexto. Se borra al terminar
    la tarea.
  2. Memoria episódica. Lo que ocurrió, indexado por tiempo:
    conversaciones, decisiones, incidencias, eventos. «El 3 de marzo se
    descartó la alineación de B-7», «el siniestro S-2026-007 se pagó con
    depreciación», «la negociación con el proveedor X se cerró con un
    descuento del 12 %». La memoria episódica es el «qué ha pasado».
  3. Memoria semántica. Hechos y conceptos estables y generalizados,
    desprendidos de los episodios: «en esta planta, la vibración de la línea
    3 casi siempre viene del acoplamiento», «el cliente Y es estratégico»,
    «el umbral de escalamiento es 50.000 €». La memoria semántica es el «qué
    sabemos».
  4. Memoria procedural. Cómo se hacen las cosas: skills, rutinas,
    playbooks, políticas operativas. «El cambio de rodamiento en esta planta
    se hace con el procedimiento modificado P-114 (no el del manual)», «antes
    de intervenir una turbina se notifica a la autoridad según N-9». La
    memoria procedural es el «cómo lo hacemos».
  5. Memoria organizacional. La que ninguna de las anteriores captura por
    sí sola: el conocimiento institucional de la empresa —decisiones
    históricas, acuerdos no documentados, lecciones de incidentes, la
    «cultura» operativa—. Es la memoria de la organización, no del agente
    individual. En la práctica, es la que más cuesta construir y la que más
    valor tiene, porque es la que no está en ningún sistema.

La diferencia entre episódica y semántica es la que más se confunde, y la
que más importa: el episodio es el hecho puntual («se pagó el siniestro X
con depreciación, en 2024»); el conocimiento semántico es la regla
generalizada que se extrae de varios episodios («los siniestros de este tipo
se pagan con depreciación según la cláusula Y»). Un agente con memoria solo
episódica repite hechos; uno con memoria semántica aplica patrones. Y un
agente con memoria procedural no empieza de cero en cada tarea.

Arquitectura

En el diagrama de la serie, la memoria es una de las dos columnas de la
recolección, junto al contexto:

                KNOWLEDGE
                     ↑
          ┌──────────┴──────────┐
          ↓                     ↓
       MEMORY                CONTEXT
  (trabajo, episódica,    (mañana: el contexto
   semántica, procedural,   que se trae en cada
   organizacional)           decisión)

La memoria se alimenta de tres fuentes que ya hemos visto: el conocimiento
estable
(que viene del grafo y del RAG), los episodios (que se generan
en la operación: conversaciones, decisiones, eventos) y el procedimiento
(playbooks y políticas). Y produce lo que el agente necesita en cada tarea:
no «todo lo que sabe», sino «lo que le sirve ahora».

Caso de uso

La empresa industrial, con su agente de mantenimiento. Descomponemos:

  1. Problema. Los técnicos pierden tiempo re-explicando al agente el
    contexto de cada incidencia, y el agente repite diagnósticos ya
    descartados, porque no recuerda nada entre intervenciones.
  2. Decisión. Recomendar el siguiente paso de diagnóstico/acción para la
    vibración de la bomba B-7.
  3. Conocimiento necesario. El procedimiento real (modificado) de
    diagnóstico de vibración; las causas probables en esta línea; el
    estado del diagnóstico ya hecho; las restricciones de seguridad.
  4. Datos. Manuales (PDF), el historial de incidencias de B-7, el estado
    de las comprobaciones (alineación, rodamientos, acoplamiento).
  5. Relaciones. Bomba B-7 → línea 3; línea 3 → patrón → acoplamiento
    roto; procedimiento P-114 → aplica a → cambio de rodamiento; B-7 →
    incidencias previas.
  6. Contexto. Es turno de noche; el técnico de guardia no es el que
    abrió la incidencia; hay una parada programada la semana próxima que
    cambia la urgencia.
  7. Memoria. Episódica: «anoche se verificó la alineación (OK)»;
    semántica: «en la línea 3, la vibración casi siempre es acoplamiento»;
    procedural: «el cambio de rodamiento usa P-114, no el manual»;
    organizacional: «tras el incidente de 2023, las vibraciones sobre umbral
    U se reportan a dirección en 24 h».
  8. Razonamiento. Excluir la alineación (ya verificada, memoria
    episódica); priorizar el acoplamiento (patón de la línea, memoria
    semántica); aplicar el procedimiento P-114 (memoria procedural);
    comprobar el umbral U (memoria organizacional) → reportar a dirección.
  9. Acción. Recomendar «comprobar acoplamiento con P-114; si la vibración
    sigue sobre U, reportar a dirección en 24 h» y registrar la decisión en
    la memoria episódica para la próxima vez.
  10. Infraestructura. Las cuatro memorias + el grafo de
    equipo→línea→patrón + el RAG de manuales. La memoria es lo que convierte
    el agente de un oráculo que empieza de cero en un técnico que «conoce
    la planta».

Trade-offs

  • Coste. Cada tipo de memoria es un subsistema: un almacén de episodios,
    un almacén de hechos, un repositorio de procedimientos. Diseñar y operar
    los cuatro es un proyecto, no una configuración.
  • Complejidad. La transición episodio→semántico (extraer patrones de
    hechos) no es trivial: hacerla mal produce «aprendizajes» que son ruido o
    sesgo. La curaduría es parte del trabajo.
  • Consistencia. Si la memoria episódica y la semántica se contradicen
    (un hecho puntual vs. un patrón general), hay que decidir cuál manda y en
    qué contexto. Sin esa regla, el agente da respuestas incoherentes.
  • Vigencia. La memoria caduca: el procedimiento P-114 se revisa, el
    patrón de la línea 3 cambia, el umbral U se modifica. Una memoria que no
    expira ni se actualiza da confianza en un pasado que ya no es.
  • Privacidad y seguridad. La memoria episódica acumula información
    sensible (conversaciones, decisiones, datos de clientes). Hay que aplicar
    permisos, retención y borrado, no solo a los datos de origen sino a lo que
    el agente recuerda.
  • Limitación honesta: la memoria del agente es una representación de
    la memoria de la empresa. Captura lo que se le dice y lo que observa en la
    operación; no captura el conocimiento tácito de la gente que no se
    explicita. Mejora lo explícito; no reemplaza a los equipos.

Implicación para la empresa

Para el CDO, la memoria es el activo que convierte el agente en una
capacidad acumulativa: cada intervención lo hace mejor, en lugar de
repetir el mismo error. Y es un activo con coste de operación: hay que
curarla, actualizarla y vigilarla.

Para el equipo de IA, la lección es de diseño: decidir qué se recuerda y
cuánto tiempo es una decisión de producto, no de ingeniería. Y medir la
memoria (¿el agente repite lo ya descartado? ¿aplica el procedimiento
correcto?) es tan importante como medir la recuperación.

Para operaciones, la implicación es la más tangible: el agente deja de
necesitar que le re-explican la planta en cada turno y empieza a operar con
el conocimiento acumulado del equipo. Eso es lo que los técnicos querían
cuando dejaron de usarlo.

Conclusión

La memoria de un agente empresarial no es una: son cuatro (trabajo,
episódica, semántica, procedural) más la organizacional, que es la que más
cuesta y más vale. Un agente sin memoria es un oráculo amnésico: brillante
en cada respuesta, inútil a lo largo del tiempo.

Pero hay un problema que la memoria por sí sola no resuelve: recordar todo
no es lo mismo que recordar lo que importa ahora. ¿Qué determina qué
información —de qué memoria, de qué fuente— se trae en cada momento
concreto? Eso es el contexto, y es el tema de mañana.

Siguiente artículo

Mañana: Una ventana de contexto enorme no significa que un agente entienda el negocio. Veremos la diferencia entre context window (la capacidad del
modelo) y business context (la información situada que la decisión
necesita), y presentaremos el concepto de context engineering.

Fuentes

  • Sumers, T. R. et al. (2023). «Cognitive Architectures for Language Agents»
    (CoALA). arXiv:2309.02427. — Tipología de memoria (working, episodic,
    semantic, procedural) formalizada para agentes LLM.
  • Definición de trabajo de la ICE: ver serie, Día 1.