Darle acceso real a lo que necesita —archivos, comandos, servicios externos— y ponerle límites explícitos a lo que no.
La idea que sobrevive a las herramientas
Dale exactamente las manos que necesita, y ponele por escrito lo que no puede tocar.
Un modelo solo puede hablar. Todo lo que hace un agente —leer un archivo, correr un test, consultar una API— es una herramienta que alguien le dio. Esa es la diferencia entre pedir una respuesta y pedir un trabajo.
El problema no es tener pocas herramientas: es no saber cuáles tiene. Si le falta la que necesita, muchas veces no te avisa, sino que produce un resultado plausible como si la hubiera usado. Y si le sobran, elige mal: veinte herramientas conectadas ocupan lugar en la ventana antes de que empiece el trabajo, y aumentan la chance de que agarre la equivocada.
El otro lado de esta disciplina son los límites. El modelo no distingue borrar un archivo temporal de borrar tu rama; esa distinción la pone el entorno, y si nadie la declaró, no existe. Los permisos declarados en un archivo se cumplen siempre. Las advertencias escritas en un prompt se cumplen casi siempre, que en algo irreversible es lo mismo que nunca.
Acá también entra el protocolo: cuando existe un estándar para conectar agentes con servicios, escribís la integración una vez y la usan todos los agentes, incluido el que uses el año que viene. Sin estándar, cada combinación de agente y servicio es un adaptador a medida.
Cómo funciona, paso a paso
Hasta acá el porqué. Esto es la máquina: qué pasa en cada etapa y, sobre todo, cuál es la decisión que te toca a vos en cada una. Si en algún paso no decidís nada, ese paso lo está decidiendo la herramienta por vos.
01
Inventario
Qué pasa
Al arrancar, el agente recibe una lista de herramientas: leer un archivo, correr un comando, consultar un servicio. Cada una es un nombre, una descripción y la forma de sus argumentos. Eso es todo lo que sabe de ellas.
Qué decidís vos
Cuáles conecta. Es la diferencia entre pedir una respuesta y pedir un trabajo, y no hay término medio: la que no está, no existe.
02
Descripción
Qué pasa
La descripción de la herramienta es el contrato. El modelo elige cuál usar leyendo ese texto, no probando: una descripción ambigua produce elecciones equivocadas de manera consistente.
Qué decidís vos
Cómo están escritas. Dos herramientas con descripciones parecidas se confunden entre sí para siempre.
03
Selección
Qué pasa
Ante un pedido elige una herramienta y arma los argumentos. Si ninguna encaja, muchas veces no avisa: produce un resultado plausible como si la hubiera usado.
Qué decidís vos
Notar el silencio. Un agente sin la herramienta necesaria no falla ruidosamente, falla convincentemente.
04
Permiso
Qué pasa
Antes de ejecutar, el entorno decide: esto corre solo, esto pide confirmación, esto no corre nunca. El modelo no clasifica el daño de un comando; esa clasificación es una decisión de configuración, tomada de antemano.
Qué decidís vos
Dónde está la frontera. Los permisos declarados en un archivo se cumplen siempre; las advertencias escritas en un prompt se cumplen casi siempre, que en algo irreversible es lo mismo que nunca.
05
Resultado
Qué pasa
Lo que devuelve la herramienta vuelve a la ventana como texto. Un comando que escupe dos mil líneas te deja dos mil líneas adentro del contexto, y a partir de ahí todo lo demás piensa peor.
Qué decidís vos
Qué vuelve entero y qué vuelve resumido. Es la fuga de contexto más común y la menos visible.
06
Costo de tenerlas
Qué pasa
Cada herramienta conectada ocupa lugar en la ventana antes de que empiece el trabajo, y suma una opción más donde equivocarse al elegir.
Qué decidís vos
Desconectar. Veinte herramientas conectadas por si acaso rinden peor que las cinco que usás.
Señales de que te falta
Te devuelve instrucciones de qué hacer en vez de hacerlo.
Afirma que corrió los tests y no los corrió.
Hizo algo irreversible sin preguntar.
Tenés tantos servidores conectados que la ventana arranca medio llena.
Errores comunes al cubrirla
Conectar todo lo que existe “por las dudas”. Cada conexión cuesta contexto y precisión.
Poner los permisos en modo permisivo para dejar de ver confirmaciones.
Confiar en que el agente va a preguntar antes de algo grave. Preguntá vos, con un permiso.
Ninguna es obligatoria. Lo obligatorio es cubrir la disciplina; estas son formas conocidas de hacerlo.
Claude Code
AnthropicArnés
Agente de terminal con permisos declarados, hooks, subagentes y skills; también en escritorio, web e IDE.
Problema, mecanismo y encaje
El dolor concreto
El modelo solo no puede leer tu repositorio ni correr tus tests. Algo tiene que armar el ciclo y decidir qué tiene permitido tocar.
Cómo funciona
Corre un ciclo sobre tu proyecto: lee, edita, ejecuta y evalúa el resultado. Los permisos se declaran en un archivo de configuración, los hooks interceptan acciones de forma determinista y los subagentes aíslan trabajo pesado del hilo principal.
Cuándo conviene
Cuando querés el ciclo en la terminal y control fino sobre permisos y automatizaciones. Si buscás edición asistida dentro del editor, un agente integrado al IDE encaja mejor.
Cursor
AnysphereArnés
Editor con el agente integrado en la superficie de edición.
Problema, mecanismo y encaje
El dolor concreto
Saltar entre la terminal y el editor rompe el hilo cuando el trabajo es sobre todo edición local.
Cómo funciona
Un editor que combina indexación del repositorio con un agente que edita en el mismo lugar donde estás mirando el código, mostrando los cambios en línea.
Cuándo conviene
Cuando el trabajo es mayormente editar archivos y querés ver el diff donde estás. Para tareas largas de muchos pasos y comandos, un agente de terminal da más control.
Codex CLI
OpenAIArnés
Agente de terminal de OpenAI, con soporte de procedimientos y servicios externos.
Problema, mecanismo y encaje
El dolor concreto
Lo mismo que cualquier agente: el modelo necesita manos.
Cómo funciona
Ciclo de agente en la terminal sobre modelos de OpenAI, con modos de aprobación configurables y capacidad de consumir procedimientos y servicios conectados.
Cuándo conviene
Cuando estás en el ecosistema de OpenAI. Vale conocerlo aunque no lo uses: correr dos agentes sobre la misma tarea es la forma más rápida de ver qué aporta el entorno y qué aporta el modelo.
OpenCode
Comunidad open sourceArnés
Agente de terminal open source, agnóstico de proveedor.
Problema, mecanismo y encaje
El dolor concreto
Atar tu flujo entero al agente de un proveedor es apostar a que ese proveedor siga siendo el mejor para siempre.
Cómo funciona
Ciclo de agente open source que se conecta a distintos proveedores de modelos, con la configuración de agentes y herramientas guardada en el repositorio.
Cuándo conviene
Cuando querés cambiar de modelo sin cambiar de flujo, o necesitás poder leer y modificar el entorno mismo.
Pi
EarendilArnés
Un arnés mínimo: corre agentes en la terminal y no trae nada más. Lo que necesites, lo agregás vos.
Problema, mecanismo y encaje
El dolor concreto
Los arneses vienen con opiniones adentro —qué permisos pedir, cómo repartir el trabajo, qué servicios conectar— y esas opiniones no siempre son las tuyas.
Cómo funciona
Terminal con modo interactivo, salida para scripts, protocolo RPC y SDK para embeberlo. Se extiende con extensiones, habilidades y plantillas de prompt que instalás desde npm o git. Enruta a más de quince proveedores y te deja cambiar de modelo a mitad de sesión. Las sesiones quedan en archivos locales.
Cuándo conviene
Cuando ya sabés qué disciplinas querés cubrir y preferís armarlas vos antes que heredar las de otro. Si todavía estás averiguando qué te falta, un arnés que no trae nada tampoco te lo va a decir.
MCP
Anthropic, estándar abiertoProtocolo
Protocolo abierto para conectar cualquier agente con herramientas, datos y servicios externos.
Problema, mecanismo y encaje
El dolor concreto
Sin un estándar, cada integración entre un agente y un servicio es un adaptador a medida, y cada agente necesita el suyo.
Cómo funciona
Un servidor expone herramientas y recursos por un protocolo común; cualquier agente compatible los consume. Escribís la integración una vez y la usan todos, incluido el agente que uses el año que viene.
Cuándo conviene
Es la razón por la que tu memoria y tu índice de código pueden sobrevivir a un cambio de herramienta. Cuidado con la avaricia: cada servidor conectado ocupa ventana antes de que empiece el trabajo.
También ayuda en
Hooks
Patrón del ecosistemaPatrón
Control
Comandos deterministas que se ejecutan en momentos definidos, sin pasar por el modelo.