PTENES
MÓDULO 2.5

🧠 Memoria y contexto

Un Jarvis sin memoria empieza desde cero con cada mensaje, y cada conversación se convierte en una presentación repetitiva y cansadora. Aquí entiendes qué recuerda el sistema, durante cuánto tiempo, qué alimenta cada decisión y cómo recuperar la información adecuada en el momento justo, sin convertirlo en un archivo entrometido. Una buena memoria no consiste en guardarlo todo: consiste en guardar lo que sirve para dar continuidad.

Entrada lo que dice el usuario memoria a corto plazo memoria a largo plazo Recuperar solo el contexto adecuado Decisión respuesta precisa La memoria alimenta la recuperación; la recuperación alimenta la decisión: guardar no es el fin, recordar en el momento adecuado sí.
6
Temas
~45
Minutos
Intermedio
Nivel
Concepto
Tipo
Progreso del módulo0 de 6 · 0%
1

📌 Qué recuerda Jarvis

Por defecto, un modelo de IA no recuerda nada: cada mensaje llega como si fuera el primero. La memoria es lo que agregas alrededor del modelo para que no vuelva a empezar desde cero. Es la diferencia entre el agente de atención que te reconoce y ya sabe cuál es tu pedido habitual, y aquel que te pregunta tu nombre cada vez. La memoria no es magia del modelo: es una decisión de arquitectura del arquitecto de intención.

🧩 La memoria es todo lo que perdura entre mensajes

Sin memoria, Jarvis vive en un eterno presente: cada turno es aislado. Con memoria, acumula información: lo que se dijo, quién es la persona y qué ya se resolvió. El arquitecto decide qué vale la pena conservar y por cuánto tiempo. Recordar ocupa espacio y atención; por eso se recuerda con intención, no por casualidad.

✓ Con memoria, el Jarvis

  • ✓Reconoce quién está hablando.
  • ✓Retoma el tema donde lo dejaste.
  • ✓No repite preguntas ya respondidas.
  • ✓Suena coherente a lo largo del tiempo.

✗ Sin memoria, Jarvis

  • ✗Pregunta tu nombre en cada mensaje.
  • ✗Olvida lo que acabas de decir.
  • ✗Contradice lo que dijo antes.
  • ✗Trata cada turno como si fuera un desconocido nuevo.
Patrón
el modelo no recuerda
Memoria
capa alrededor
Decisión
de arquitectura
Efecto
continuidad
2

🗂️ Tipos de memoria

No todos los tipos de memoria son iguales. Hay tres plazos que el arquitecto debe distinguir: a memoria de sesión (sirve solo durante la conversación actual), la memoria a corto plazo (sirve durante algunas interacciones o por el día) y la memoria a largo plazo (atraviesa conversaciones — lo que define quién es esa persona). Mezclar las tres es una de las mayores fuentes de confusión en proyectos de IA.

⏱️ Los tres plazos de la memoria

  • Sesión: lo que se está diciendo ahora, en esta conversación. Termina cuando termina la conversación: es el bloc de notas sobre la mesa.
  • Corto plazo: lo que vale la pena recordar durante algunas interacciones o por el día ("ya me pasaste esta solicitud hoy"). Expira por sí solo.
  • Largo plazo: lo que define a la persona y está presente en todas las conversaciones: nombre, preferencias, historial relevante. Es el registro persistente.

Cómo evoluciona la memoria durante una conversación

1. El cliente abre la conversación

Se consulta la memoria a largo plazo: Jarvis ya conoce el nombre y el historial. La sesión empieza vacía.

2. Durante la conversación

Cada mensaje entra en la memoria de sesión. Jarvis vincula "el producto que mencioné" con el elemento citado tres turnos atrás.

3. Surge algo que vale la pena guardar

"Prefiero que me llamen por mi apodo" promueve un hecho de la sesión a la memoria a largo plazo.

4. La conversación termina

La memoria de la sesión se descarta; solo sobrevive para la próxima conversación lo que se haya conservado.

Sesión
solo esta conversación
Corto plazo
horas o el día
Largo plazo
lo atraviesa todo
Promover
sesión → larga
3

🍱 Contexto: lo que alimenta la decisión

La memoria es lo que Jarvis tiene guardado; contexto es lo que pone sobre la mesa para decidir ahora. Son cosas diferentes. Con cada respuesta, el sistema arma un «plato» con fragmentos de la memoria, el mensaje actual, la identidad (el alma) y las reglas. Ese plato es el contexto, y la calidad de la respuesta depende mucho más de lo que contiene que del tamaño del modelo.

💡 Consejo práctico

Cuando Jarvis "responde mal", la primera pregunta no es "¿qué prompt hay que mejorar?", sino "¿qué había en el contexto al momento de esta respuesta?". Muchas fallas se deben a que falta contexto (no recibió la información) o a que sobra contexto (ruido que desvió la atención), no a la falta de inteligencia.

Lo que suele formar parte del contexto de una respuesta

•El alma: quién es y cuáles son sus límites.
•El mensaje actual: lo que se está pidiendo.
•Fragmentos de la memoria: solo los relevantes.
•Datos del negocio: precio, inventario, estado.
•Las reglas: lo que se puede y lo que no se puede.
•La tarea en curso: en qué paso estamos.
Memoria
lo que guarda
Contexto
lo que entra ahora
Calidad
viene del contexto
Diagnóstico
"¿qué había sobre la mesa?"
4

🔎 Recuperar la información adecuada

Guardar muchas cosas no sirve si Jarvis no puede encontrar el fragmento correcto en el momento adecuado. Recuperar es el arte de traer, de una memoria grande, solo los fragmentos que importan para la pregunta actual. No se vierte toda la memoria en el contexto: eso es caro, lento y estorba. Se recupera según la relevancia: lo que tiene que ver con lo que se está pidiendo ahora.

🎯 La regla de oro de la recuperación

Trae lo suficiente para responder bien, y nada más. Demasiada memoria en el contexto no hace que Jarvis sea más inteligente: lo vuelve más confuso y más caro. El secreto no es recordarlo todo, sino recordar lo que sirve para esta respuesta.

✓ Recuperación saludable

  • ✓Trae fragmentos relacionados con la pregunta actual.
  • ✓Prioriza lo más reciente y relevante.
  • ✓Resume lo que es largo antes de usarlo.
  • ✓Deja fuera lo que no viene al caso.

✗ Recuperación deficiente

  • ✗Vuelca toda la memoria en el contexto.
  • ✗Mezcla temas sin relación.
  • ✗Repite datos viejos y desactualizados.
  • ✗Es costoso y responde despacio.

Recuperación en una línea de razonamiento

pregunta: "¿cuál era el plazo de mi pedido?"
busca_por: solicitudes + este cliente + plazo
trae: solo el pedido #4471 y su plazo
ignora: conversaciones antiguas sobre otros temas
contexto_final: conciso y preciso

Esquema ilustrativo de recuperación por relevancia — no es código real.

Relevancia
relacionado con la pregunta
Recencia
lo más reciente tiene más peso
Resumir
comprimir lo extenso
Suficiente
no soltarlo todo
5

🚫 Qué NO guardar

La tentación de quien empieza es guardar todo «por si acaso». El arquitecto hace lo contrario: decide qué NO guardar. Aquí pesan dos motivos: privacidad (datos sensibles que no deberían conservarse) y ruido (basura que solo dificulta la recuperación). Guardarlo todo es, al mismo tiempo, un riesgo legal y un veneno para la calidad. Una memoria limpia es una memoria útil.

✗
Datos sensibles sin necesidad — riesgo de privacidad.

Contraseñas, documentos completos, datos de tarjetas: si no necesitas guardarlos, no los guardes.

✗
Charla trivial y ruido — veneno de la recuperación.

"Buenos días", "gracias", desahogos sin hechos: ocupan espacio y dificultan encontrar lo que importa.

✗
Información que envejece rápido — se convierte en mentira.

Precio de hoy, existencias del momento: guardarlos como una verdad fija hace que Jarvis afirme datos desactualizados.

💡 Consejo práctico

Antes de guardar algo en la memoria a largo plazo, responde tres preguntas: ¿esto es sensible? (si sí, evítalo o protégelo), ¿esto volverá a servir? (si no, descártalo) y ¿esto seguirá siendo verdad mañana? (si no, busca en la fuente en lugar de guardarlo).

Privacidad
no guardar información sensible
Ruido
fuera de la memoria
Validez
lo que envejece
Memoria limpia
memoria útil
6

🔗 Memoria al servicio de la continuidad

Todo esto existe por un solo motivo: continuidad. La memoria no es un trofeo por cuánto acumula el sistema: es lo que hace que Jarvis parezca una sola presencia coherente, en vez de mil agentes de atención desconectados. El objetivo final no es "recordar mucho", sino hacer que la persona sienta que está hablando con alguien que la conoce y continúa desde donde quedaron.

🧭 La brújula de la memoria

Ante "¿guardo esto?", la pregunta correcta es: ¿esto ayuda a Jarvis a mantener mejor la relación mañana? Si ayuda, vale la pena conservarlo en la memoria. Si no, es un peso. La continuidad es el criterio que distingue la memoria de la acumulación, y es la que convierte respuestas aisladas en una experiencia única y confiable.

El contraste, una línea cada uno

sem_memoria: "¡Hola! ¿En qué puedo ayudar?" (otra vez)
com_memoria: "¡Hola, Ana! Sobre el pedido de ayer..."
acumulo_cego: lo recuerda todo, no encuentra nada, filtra datos
memoria_boa: recuerda lo que sirve, en el momento adecuado

Ilustración del efecto de la memoria en la experiencia —no es una configuración real.

Objetivo
continuidad
Criterio
"¿ayuda mañana?"
Presencia
única y coherente
Resultado
relación, no turnos

Autoevaluación (opcional): ¿cuál es el criterio que distingue una buena memoria de la mera acumulación?

🧠 Resumen del módulo

✓
Qué recuerda Jarvis — la memoria es la capa que rodea al modelo, una decisión de arquitectura.
✓
Tipos de memoria — sesión, corto plazo y largo plazo; cada una con su tiempo de vida.
✓
Contexto — lo que se pone sobre la mesa para decidir ahora; la calidad nace de ahí.
✓
Recuperar lo correcto — traer lo suficiente según la relevancia, y nada más.
✓
Qué NO guardar — privacidad y ruido; una memoria limpia es una memoria útil.
✓
Al servicio de la continuidad — el objetivo no es recordar mucho, sino mantener la relación.

Siguiente módulo:

2.6 — Muros de seguridad: cómo opera Jarvis dentro de límites claros y seguros.