Hay miles y salen más cada semana. Lo primero que importa de una herramienta es qué disciplina cubre. Si no sabés cuál cubre, no sabés si te hace falta.
Fijate en la portabilidad. Lo que guardás en una herramienta que solo habla con un agente lo perdés el día que cambiás de agente — y vas a cambiar.
Ir a una disciplina
Qué es cada cosa
Cada entrada de este catálogo lleva una forma. No es una etiqueta decorativa: define cómo se instala, quién la hereda y qué pasa el día que la sacás. Dos herramientas que cubren la misma disciplina con formas distintas no son intercambiables.
Arnés
El programa desde el cual trabajás con el agente: una terminal, un editor, una extensión. No es el modelo — el modelo solo produce texto — es lo que convierte ese texto en acciones sobre tu máquina.
Qué te da
Tres cosas que sin él no tenés. El ciclo: leer, actuar, mirar el resultado y volver a decidir, en vez de que vos copies y pegues entre una ventana de chat y tu editor. La frontera de permisos: qué se ejecuta solo, qué te pregunta, qué no corre nunca. Y los puntos de extensión: dónde enchufás tus reglas, tus habilidades, tus subagentes. Sin arnés no hay flujo de trabajo que ingenierear, hay una conversación de la que copiás cosas a mano.
Índice
Una base de datos de tu código: qué símbolos existen, quién llama a qué, qué archivo depende de cuál. Se construye una vez y se actualiza a medida que escribís.
Qué te da
Respuestas exactas en vez de búsquedas. Preguntarle quién usa una función devuelve la lista; encontrar lo mismo leyendo cuesta decenas de archivos y sigue sin garantizar que los encontraste a todos.
Servicio
Un proceso que corre aparte y guarda algo entre sesiones. El agente le habla; el estado vive del lado del servicio, no de la conversación.
Qué te da
Persistencia real y, si se expone por un protocolo abierto, la posibilidad de que lo lea también el agente que uses el año que viene.
Archivo
Un archivo de texto en el repositorio con reglas, contexto o instrucciones. La forma más simple que existe, y la que menos gente usa en serio.
Qué te da
Herencia sin coordinación. Quien clona el proyecto lo tiene, sin que nadie se lo cuente y sin instalar nada. Viaja con el código y se revisa en el pull request como cualquier otro cambio.
Protocolo
Un estándar para que un agente hable con servicios externos sin que cada combinación de agente y servicio sea un adaptador a medida.
Qué te da
Escribís la integración una vez y la usan todos los agentes que hablen el estándar. Es la diferencia entre una integración y N.
Procedimiento
Un conjunto de pasos con un orden y un criterio de salida. No se instala: se sigue.
Qué te da
Que el resultado no dependa de quién lo pidió ni de cómo venía el día. Es lo más barato de adoptar y lo más fácil de abandonar.
Paquete
Un procedimiento envuelto en un archivo que el agente puede cargar solo: los pasos, más una descripción de cuándo aplican. Lo que instalás es el paquete; lo que se sigue es el procedimiento que trae adentro.
Qué te da
Que el procedimiento aparezca sin que nadie se acuerde de invocarlo, y que no ocupe contexto hasta que la tarea coincida. El archivo viaja; cómo se descubre, se carga y se ordena frente a otros es cosa del arnés.
Flujo de trabajo
Un procedimiento ya empaquetado y ejecutable: fases, artefactos entre fases y compuertas, con las órdenes ya escritas.
Qué te da
Que el procedimiento se cumpla sin depender de la memoria de nadie. El costo es que trae opiniones adentro, y algunas no van a ser las tuyas.
Patrón
Una forma conocida de resolver algo, que no pertenece a ningún producto. No hay nada que instalar ni nada que actualizar.
Qué te da
La idea viaja entera, porque no pertenece a ningún producto. El cableado no: cada arnés lo implementa a su manera, y esa parte la reescribís al mudarte. A cambio no te da ninguna garantía: un patrón que nadie aplica es una idea linda.
01
Memoria
¿Qué sobrevive cuando cerrás la terminal?
Guardar las decisiones que vas tomando —y el porqué de cada una— en algún lugar que siga existiendo mañana, y que cualquier herramienta de IA pueda leer.
Engram
Gentleman ProgrammingServicio
Memoria persistente para agentes de código, con búsqueda, tipos de observación y detección de conflictos entre memorias.
Problema, mecanismo y encaje
El dolor concreto
La decisión de arquitectura de ayer se evaporó al cerrar la terminal, y mañana el agente va a proponer la alternativa que ya descartaron.
Cómo funciona
Guarda observaciones tipadas —decisiones, bugs resueltos, convenciones, descubrimientos— asociadas a un proyecto, y las expone por un protocolo abierto para que cualquier agente las busque. Cuando una memoria nueva contradice una vieja, lo marca en vez de pisarla en silencio.
Cuándo conviene
Cuando el proyecto vive meses y las decisiones importan más que el código. La detección de conflictos es lo que la separa de un archivo de notas: una memoria vieja que ya es falsa hace más daño que no tener ninguna.
gbrain
Garry TanServicio
Base de conocimiento en Markdown con búsqueda híbrida, grafo de entidades y respuestas sintetizadas con citas.
Problema, mecanismo y encaje
El dolor concreto
La mayoría de los sistemas de notas te devuelven una lista de páginas. Vos no querés páginas: querés la respuesta, y querés saber qué te falta.
Cómo funciona
Sincroniza repositorios de Markdown a una base con búsqueda vectorial. Combina búsqueda semántica y por palabra clave con reordenamiento, arma un grafo de entidades con relaciones tipadas, y sintetiza respuestas citando las fuentes —incluyendo lo que no encontró.
Cuándo conviene
Cuando el conocimiento que necesitás no está en el código: contexto de negocio, gente, decisiones, investigación. Para saber qué existe en el repositorio, un índice de código es la herramienta correcta.
claude-mem
Alex NewmanServicio
Memoria que captura observaciones sola, sin que se lo pidas, y las reinyecta al iniciar la sesión.
Problema, mecanismo y encaje
El dolor concreto
Una memoria que depende de que el agente se acuerde de guardar es una memoria que se va a olvidar de guardar.
Cómo funciona
Un disparador registra observaciones comprimidas después de cada acción —bugs, decisiones, descubrimientos— en una base local con búsqueda semántica. Al iniciar sesión, otro disparador inyecta un resumen del proyecto sin que el modelo tenga que pedirlo.
Cuándo conviene
Cuando querés captura pasiva y cero fricción. El precio es control: capturás todo, ruido incluido. La captura explícita cuesta disciplina pero produce memorias más limpias.
02
Contexto
¿Qué sabe de tu mundo, ahora mismo?
Hacer que el agente tenga a mano lo que realmente existe: tu código, quién llama a qué, y la documentación de la versión de la librería que usás vos.
CodeGraph
Colby McHenryÍndice
Índice de tu código como grafo: símbolos, quién llama a qué, dependencias y radio de impacto.
Problema, mecanismo y encaje
El dolor concreto
Buscar con grep y leer archivos enteros para entender una función quema la ventana y aún así se pierde quién la llama.
Cómo funciona
Indexa el repositorio como un grafo de símbolos y relaciones. Una consulta devuelve el código relevante con números de línea, los caminos de llamada entre símbolos y un resumen de qué se rompe si tocás eso — en una sola vuelta, en vez de un ciclo de búsquedas y lecturas.
Cuándo conviene
En cualquier repositorio que ya no entra en la cabeza de una persona. La ganancia no es solo precisión: el agente gasta contexto en pensar en vez de en buscar.
Context7
UpstashServicio
Trae la documentación actual y versionada de la librería que estás usando, directo al contexto.
Problema, mecanismo y encaje
El dolor concreto
El modelo aprendió la API de una librería en un momento del pasado. Vos tenés instalada otra versión. De ese desfase salen las llamadas que parecen correctas y no existen.
Cómo funciona
Se conecta como servicio externo y expone dos operaciones: resolver el identificador de una librería y traer su documentación y ejemplos actuales para la versión que corresponde.
Cuándo conviene
Cuando trabajás con librerías que se mueven rápido, o cuando el agente insiste con una API que ya no existe. Se conecta en minutos y ataca una causa de error entera.
03
Estándares
¿Qué significa “bien hecho” en este proyecto?
Escribir una sola vez las reglas, convenciones y procedimientos del proyecto, en un lugar que el agente lee solo, sin que se lo recuerdes.
AGENTS.md
Estándar abierto, Agentic AI FoundationArchivo
Un archivo en el repositorio con las reglas del proyecto, que el agente carga solo al arrancar. Un formato abierto que leen un par de docenas de agentes, de Codex y Gemini CLI a Cursor, Copilot y Devin.
Problema, mecanismo y encaje
El dolor concreto
Repetir en cada conversación “usá pnpm”, “los tests van acá”, “no toques esa carpeta” es desperdicio puro, y se pierde cuando cambia el equipo.
Cómo funciona
El agente lee el archivo al iniciar y lo antepone al contexto. Los equivalentes propios de cada herramienta —CLAUDE.md en Claude Code, y otros— son adaptadores alrededor del mismo conocimiento del proyecto: el contenido es portable, mientras que el nombre del archivo, las reglas de carga y la precedencia entre varios son cosa del arnés. Es la cobertura más barata que existe y la más subestimada: cuesta una tarde y no depende de instalar nada.
Cuándo conviene
Siempre, y es lo primero que hay que hacer. El error típico es escribirlo como documentación para humanos: son órdenes ejecutables, cortas y sin ambigüedad.
Agent Skills
Anthropic, estándar abiertoPaquete
Procedimientos empaquetados como carpeta —instrucciones, scripts, recursos— que el agente carga solo cuando aparece la tarea que los necesita.
Problema, mecanismo y encaje
El dolor concreto
El agente resuelve la misma tarea distinto cada vez, y la forma correcta de hacerla en tu equipo no está en sus pesos.
Cómo funciona
Un directorio con un SKILL.md en la raíz: instrucciones, más una descripción de cuándo aplican, más los scripts y archivos que el procedimiento necesite. La carga es progresiva —el agente solo tiene el nombre y la descripción hasta que una tarea coincide, y ahí lee el resto—, así que lo que te cuesta una skill inactiva es su descripción, no su contenido.
Cuándo conviene
Cuando un procedimiento se repite y tiene una forma correcta. Es la diferencia entre pedir un resultado y enseñar un método.
04
Capacidad
¿Qué puede tocar, y qué no debería poder tocar?
Darle acceso real a lo que necesita —archivos, comandos, servicios externos— y ponerle límites explícitos a lo que no.
Claude Code
AnthropicArnés
Agente de terminal con permisos declarados, hooks, subagentes y skills; también en escritorio, web e IDE.
Problema, mecanismo y encaje
El dolor concreto
El modelo solo no puede leer tu repositorio ni correr tus tests. Algo tiene que armar el ciclo y decidir qué tiene permitido tocar.
Cómo funciona
Corre un ciclo sobre tu proyecto: lee, edita, ejecuta y evalúa el resultado. Los permisos se declaran en un archivo de configuración, los hooks interceptan acciones de forma determinista y los subagentes aíslan trabajo pesado del hilo principal.
Cuándo conviene
Cuando querés el ciclo en la terminal y control fino sobre permisos y automatizaciones. Si buscás edición asistida dentro del editor, un agente integrado al IDE encaja mejor.
Cursor
AnysphereArnés
Editor con el agente integrado en la superficie de edición.
Problema, mecanismo y encaje
El dolor concreto
Saltar entre la terminal y el editor rompe el hilo cuando el trabajo es sobre todo edición local.
Cómo funciona
Un editor que combina indexación del repositorio con un agente que edita en el mismo lugar donde estás mirando el código, mostrando los cambios en línea.
Cuándo conviene
Cuando el trabajo es mayormente editar archivos y querés ver el diff donde estás. Para tareas largas de muchos pasos y comandos, un agente de terminal da más control.
Codex CLI
OpenAIArnés
Agente de terminal de OpenAI, con soporte de procedimientos y servicios externos.
Problema, mecanismo y encaje
El dolor concreto
Lo mismo que cualquier agente: el modelo necesita manos.
Cómo funciona
Ciclo de agente en la terminal sobre modelos de OpenAI, con modos de aprobación configurables y capacidad de consumir procedimientos y servicios conectados.
Cuándo conviene
Cuando estás en el ecosistema de OpenAI. Vale conocerlo aunque no lo uses: correr dos agentes sobre la misma tarea es la forma más rápida de ver qué aporta el entorno y qué aporta el modelo.
OpenCode
Comunidad open sourceArnés
Agente de terminal open source, agnóstico de proveedor.
Problema, mecanismo y encaje
El dolor concreto
Atar tu flujo entero al agente de un proveedor es apostar a que ese proveedor siga siendo el mejor para siempre.
Cómo funciona
Ciclo de agente open source que se conecta a distintos proveedores de modelos, con la configuración de agentes y herramientas guardada en el repositorio.
Cuándo conviene
Cuando querés cambiar de modelo sin cambiar de flujo, o necesitás poder leer y modificar el entorno mismo.
Pi
EarendilArnés
Un arnés mínimo: corre agentes en la terminal y no trae nada más. Lo que necesites, lo agregás vos.
Problema, mecanismo y encaje
El dolor concreto
Los arneses vienen con opiniones adentro —qué permisos pedir, cómo repartir el trabajo, qué servicios conectar— y esas opiniones no siempre son las tuyas.
Cómo funciona
Terminal con modo interactivo, salida para scripts, protocolo RPC y SDK para embeberlo. Se extiende con extensiones, habilidades y plantillas de prompt que instalás desde npm o git. Enruta a más de quince proveedores y te deja cambiar de modelo a mitad de sesión. Las sesiones quedan en archivos locales.
Cuándo conviene
Cuando ya sabés qué disciplinas querés cubrir y preferís armarlas vos antes que heredar las de otro. Si todavía estás averiguando qué te falta, un arnés que no trae nada tampoco te lo va a decir.
MCP
Anthropic, estándar abiertoProtocolo
Protocolo abierto para conectar cualquier agente con herramientas, datos y servicios externos.
Problema, mecanismo y encaje
El dolor concreto
Sin un estándar, cada integración entre un agente y un servicio es un adaptador a medida, y cada agente necesita el suyo.
Cómo funciona
Un servidor expone herramientas y recursos por un protocolo común; cualquier agente compatible los consume. Escribís la integración una vez y la usan todos, incluido el agente que uses el año que viene.
Cuándo conviene
Es la razón por la que tu memoria y tu índice de código pueden sobrevivir a un cambio de herramienta. Cuidado con la avaricia: cada servidor conectado ocupa ventana antes de que empiece el trabajo.
05
Método
¿En qué orden se hace el trabajo, y quién hace cada parte?
Partir el trabajo en fases con entregables entre una y otra, en vez de pedir una tarea grande de una sola vez y esperar a ver qué sale.
OpenSpec
Fission AIFlujo de trabajo
Desarrollo guiado por especificación en archivos: lo que ya está acordado, separado de lo que se está proponiendo.
Problema, mecanismo y encaje
El dolor concreto
Acordás en el chat qué hay que construir, el agente construye otra cosa, y no hay dónde señalar lo que se había acordado. La conversación donde vivía la decisión ya se cerró.
Cómo funciona
Mantiene en el repositorio las especificaciones vigentes separadas de los cambios propuestos. Cada cambio abre una carpeta con la propuesta, las specs delta, el diseño y las tareas; cuando se aplica y se verifica, las deltas se funden en lo vigente y el cambio se archiva. Todo es markdown en tu repo: los comandos se regeneran para el asistente que uses, los archivos no.
Cuándo conviene
Cuando el desacuerdo entre lo que pediste y lo que salió es tu problema repetido, y querés que la discusión pase antes de escribir el código. Para un cambio de dos líneas es puro costo.
Gentle AI
Gentleman ProgrammingFlujo de trabajo
Instalador reproducible de configuraciones, desarrollo por fases guiado por especificación, y revisión con presupuesto.
Problema, mecanismo y encaje
El dolor concreto
Un entorno configurado a mano no se repite en otra máquina. Y una revisión hecha por IA sin límite no converge sola: volvés a preguntar y aparece otra observación.
Cómo funciona
Instala y sincroniza agentes, procedimientos y perfiles por preset y por ámbito. Aporta un ciclo por fases —explorar, proponer, especificar, diseñar, tareas, aplicar, verificar, archivar— y una revisión acotada que elige el tipo de análisis según el riesgo del cambio, con un presupuesto de corrección fijado de antemano.
Cuándo conviene
Cuando el problema dejó de ser hacer que el agente funcione, y pasó a ser que funcione igual en todas las máquinas y que la revisión cierre.
gstack
Garry TanFlujo de trabajo
Más de veinte procedimientos que reparten roles de producto —producto, diseño, QA, release— sobre un ciclo de sprint.
Problema, mecanismo y encaje
El dolor concreto
Un solo agente haciendo de todo hace todo a medias. Planificar, diseñar, revisar y publicar aplican criterios distintos.
Cómo funciona
Instala comandos que encadenan un ciclo de pensar, planificar, construir, revisar, testear, publicar y reflexionar, con entregables que pasan de una fase a la siguiente. Funciona sobre varios agentes distintos.
Cuándo conviene
Cuando trabajás solo y necesitás los criterios que aportaría un equipo. Es una opinión fuerte sobre cómo se construye software: si no coincide con la tuya, vas a pelearte con la herramienta.
Subagentes
Patrón del ecosistemaPatrón
Agentes secundarios con contexto propio para el trabajo que no debe inflar el hilo principal.
Problema, mecanismo y encaje
El dolor concreto
Leer veinte archivos para responder una pregunta te deja veinte archivos en la ventana, y a partir de ahí todo lo demás piensa peor.
Cómo funciona
El agente principal delega una tarea acotada a uno secundario, que trabaja en su propio contexto y devuelve solo la conclusión. El costo del trabajo sucio no se paga en tu ventana.
Cuándo conviene
Cuando una tarea produce mucho ruido y poca conclusión. El error inverso sale igual de caro: delegar algo que ya sabías obliga al otro a redescubrirlo desde cero.
06
Control
¿Cómo sabés que lo que hizo funciona?
Tener algo que asuma que el agente se equivocó y lo compruebe: tests que fallan primero, revisión que no la haga quien escribió, y controles que no se pueden saltear.
Skills for Real Engineers
Matt PocockPaquete
Colección de procedimientos armada alrededor de las fallas concretas del desarrollo asistido.
Problema, mecanismo y encaje
El dolor concreto
Los procedimientos genéricos no sirven de mucho. Estos atacan fallas con nombre: que entendió otra cosa de la que pediste, código con bugs, arquitectura que se degrada sola.
Cómo funciona
Procedimientos que te interrogan antes de codear para alinear qué se va a construir, arman un archivo con el vocabulario del dominio, imponen ciclos de test-primero, y aplican un método estructurado para diagnosticar bugs.
Cuándo conviene
Cuando ya tenés el entorno andando y el problema pasó a ser la disciplina, no la capacidad. La idea de fondo —acordar el vocabulario del dominio antes de escribir código— vale aunque no instales nada.
Hooks
Patrón del ecosistemaPatrón
Comandos deterministas que se ejecutan en momentos definidos, sin pasar por el modelo.
Problema, mecanismo y encaje
El dolor concreto
Pedirle al modelo que “siempre corra el linter antes de commitear” es una sugerencia. A veces la cumple. En algo innegociable, a veces es igual que nunca.
Cómo funciona
El entorno ejecuta un comando en un punto del ciclo —antes de una acción, al iniciar sesión, al terminar— y usa su salida. Como no pasa por el modelo, no admite interpretación ni olvido.
Cuándo conviene
Para todo lo que tenga que pasar siempre. Si lo describirías como “sin excepción”, va en un hook y no en un prompt.