Guardar las decisiones que vas tomando —y el porqué de cada una— en algún lugar que siga existiendo mañana, y que cualquier herramienta de IA pueda leer.
La idea que sobrevive a las herramientas
Lo que no persiste, no existe. Y si persiste solo adentro de una herramienta, tampoco.
El modelo no aporta memoria durable del proyecto. Tu arnés puede muy bien guardar historial de sesión —transcripciones para retomar, ramificar, resumir— pero una transcripción es el registro de una conversación, no el registro de lo que el proyecto decidió, y es de ese producto. Lo que tiene que sobrevivir a sesiones, herramientas y personas necesita una capa de persistencia que elegiste vos. Sin eso, nada de lo que resolvieron juntos se convierte en algo sobre lo que la próxima sesión pueda actuar: no es que se olvidó, es que nunca lo tuvo. Lo único que queda es el código, y el código te dice qué hiciste pero no por qué elegiste eso en vez de lo otro.
Ese porqué es lo caro. Es lo que discutiste dos horas, lo que probaste y no funcionó, la restricción del cliente que no está escrita en ningún lado. Reconstruirlo cuesta más que escribir el código de nuevo.
Y hay una segunda parte, que es la que casi nadie mira: la memoria tiene que ser tuya, no de la herramienta. Si tus decisiones viven adentro de un producto que solo habla con un agente, el día que cambies de agente empezás de cero. Y vas a cambiar: cambiaste al menos una vez en el último año. Una capa de memoria que se expone por un protocolo abierto la puede leer cualquier agente, ahora y el que venga.
El criterio de qué guardar es simple: guardá lo que no se puede deducir leyendo el repositorio. Que usan pnpm se deduce. Que descartaron una librería porque el equipo de infra no la aprueba, no.
Cómo funciona, paso a paso
Hasta acá el porqué. Esto es la máquina: qué pasa en cada etapa y, sobre todo, cuál es la decisión que te toca a vos en cada una. Si en algún paso no decidís nada, ese paso lo está decidiendo la herramienta por vos.
01
Captura
Qué pasa
Algo dispara un guardado: cerraste una discusión, arreglaste un bug, acordaron una convención. El disparador puede ser vos escribiéndolo o el agente detectando que se tomó una decisión.
Qué decidís vos
Qué cuenta como disparador. Si se guarda en cada mensaje, la memoria se vuelve ruido; si se guarda solo cuando te acordás, no se guarda nunca.
02
Forma
Qué pasa
Cada recuerdo se escribe con la misma estructura: qué se hizo, por qué, qué archivos toca y qué te sorprendió. Sin estructura no hay después con qué filtrar.
Qué decidís vos
El criterio de qué entra: lo que no se puede deducir leyendo el repositorio. Que usan pnpm se deduce. Que descartaron una librería porque infraestructura no la aprueba, no.
03
Índice
Qué pasa
Lo guardado se indexa por proyecto, por fecha y por tema, y casi siempre también por significado —un vector— para poder buscar por lo que quisiste decir en vez de por las palabras exactas que usaste.
Qué decidís vos
Los temas. Un tema estable, del estilo `arquitectura/auth`, hace que la decisión de hoy actualice a la de marzo en vez de convivir con ella y contradecirla en silencio.
04
Recuperación
Qué pasa
Ante una consulta se mezclan tres señales: parecido semántico, cercanía en el tiempo y coincidencia de tema. Vuelve un puñado, no todo. Traer cincuenta recuerdos es tan inútil como no traer ninguno.
Qué decidís vos
Cuántos y desde cuándo. Es la perilla que decide si la memoria ayuda o si tapa el pedido que acabás de escribir.
05
Inyección
Qué pasa
Los recuerdos elegidos entran en la ventana como texto plano, antes de tu mensaje, y ocupan lugar igual que cualquier otra cosa. Esta es la parte que casi nadie mira: la memoria no es gratis, se paga en contexto.
Qué decidís vos
El presupuesto. Si la memoria se come un tercio de la ventana, el agente arranca cada tarea con menos lugar para el problema real.
06
Revisión
Qué pasa
Un recuerdo puede quedar falso sin avisar. Los sistemas serios le ponen estado —vigente, a revisar— y ese estado viaja con el recuerdo cada vez que se recupera.
Qué decidís vos
Confirmar o descartar. Esto no lo puede hacer nadie más: el agente no tiene forma de saber si aquella restricción del cliente sigue en pie.
Señales de que te falta
Arrancás la sesión pegando un resumen de lo que venías haciendo.
El agente propone algo que ya probaron y no funcionó.
Alguien pregunta “¿por qué esto está hecho así?” y nadie sabe.
Cambiaste de herramienta de IA y sentiste que volvías a empezar.
Errores comunes al cubrirla
Guardar el qué sin el porqué. Una decisión sin su motivo se revierte sola en tres semanas.
Guardar todo. Una memoria llena de ruido es una memoria que nadie consulta.
Dejar que la memoria envejezca sin revisión. Una memoria vieja que ya es falsa es peor que no tener memoria.
Confundirla con el archivo de instrucciones. Las instrucciones son reglas permanentes; la memoria es historia.
Ninguna es obligatoria. Lo obligatorio es cubrir la disciplina; estas son formas conocidas de hacerlo.
Engram
Gentleman ProgrammingServicio
Memoria persistente para agentes de código, con búsqueda, tipos de observación y detección de conflictos entre memorias.
Problema, mecanismo y encaje
El dolor concreto
La decisión de arquitectura de ayer se evaporó al cerrar la terminal, y mañana el agente va a proponer la alternativa que ya descartaron.
Cómo funciona
Guarda observaciones tipadas —decisiones, bugs resueltos, convenciones, descubrimientos— asociadas a un proyecto, y las expone por un protocolo abierto para que cualquier agente las busque. Cuando una memoria nueva contradice una vieja, lo marca en vez de pisarla en silencio.
Cuándo conviene
Cuando el proyecto vive meses y las decisiones importan más que el código. La detección de conflictos es lo que la separa de un archivo de notas: una memoria vieja que ya es falsa hace más daño que no tener ninguna.
gbrain
Garry TanServicio
Base de conocimiento en Markdown con búsqueda híbrida, grafo de entidades y respuestas sintetizadas con citas.
Problema, mecanismo y encaje
El dolor concreto
La mayoría de los sistemas de notas te devuelven una lista de páginas. Vos no querés páginas: querés la respuesta, y querés saber qué te falta.
Cómo funciona
Sincroniza repositorios de Markdown a una base con búsqueda vectorial. Combina búsqueda semántica y por palabra clave con reordenamiento, arma un grafo de entidades con relaciones tipadas, y sintetiza respuestas citando las fuentes —incluyendo lo que no encontró.
Cuándo conviene
Cuando el conocimiento que necesitás no está en el código: contexto de negocio, gente, decisiones, investigación. Para saber qué existe en el repositorio, un índice de código es la herramienta correcta.
claude-mem
Alex NewmanServicio
Memoria que captura observaciones sola, sin que se lo pidas, y las reinyecta al iniciar la sesión.
Problema, mecanismo y encaje
El dolor concreto
Una memoria que depende de que el agente se acuerde de guardar es una memoria que se va a olvidar de guardar.
Cómo funciona
Un disparador registra observaciones comprimidas después de cada acción —bugs, decisiones, descubrimientos— en una base local con búsqueda semántica. Al iniciar sesión, otro disparador inyecta un resumen del proyecto sin que el modelo tenga que pedirlo.
Cuándo conviene
Cuando querés captura pasiva y cero fricción. El precio es control: capturás todo, ruido incluido. La captura explícita cuesta disciplina pero produce memorias más limpias.
También ayuda en
MCP
Anthropic, estándar abiertoProtocolo
Capacidad
Protocolo abierto para conectar cualquier agente con herramientas, datos y servicios externos.