¿Qué es un harness de agente?
Un harness de agente es el runtime y sistema de control alrededor de un modelo de IA que convierte outputs del modelo en trabajo confiable y con estado. Gestiona loop, tools, contexto, memoria, permisos, entornos, aprobaciones, observabilidad, retries y condiciones de parada.
El modelo aporta razonamiento y generación. El harness decide qué ve, qué tools puede llamar, cómo vuelven los resultados, qué persiste entre sesiones, cuándo interviene una persona y cómo se recupera una falla.
El mismo modelo puede producir agentes muy distintos porque el harness define entorno, memoria, interfaces y feedback loop.
¿Por qué es importante?
La calidad de un agente no depende solo del modelo. Sin buen harness puede perder estado, llamar tools mal, repetir acciones, saturar contexto, exponer datos o detenerse antes de completar la tarea.
La decisión build versus buy define control y lock-in. Un harness administrado acelera el lanzamiento. Uno custom u open da más control sobre memoria, contexto, routing, ubicación de datos, tools, evaluación y deployment.
La independencia de modelos importa cuando el mejor cambia por tarea. Si memoria, skills, traces y estado son portables, el equipo puede probar Claude, GPT, Gemini u otros sin reconstruir el contexto acumulado.
Cómo funciona
Empezá por contratos explícitos: estado de tarea, schemas de tools, permisos, éxito, stop conditions y eventos. Poné el acceso a modelos detrás de un adapter para cambiar provider sin alterar tools ni memoria.
El loop arma contexto, llama al modelo, valida tools, ejecuta en un entorno acotado, registra resultados, actualiza estado durable y repite hasta completar, escalar o agotar budget.
En producción sumá checkpoints, idempotencia, approvals, sandboxing, aislamiento de credenciales, timeouts, tracing, evals y replay. Claude Agent SDK ejecuta el loop en un proceso propio; Claude Managed Agents ofrece harness e infraestructura administrados.
Ejemplo técnico
Un equipo crea un agente que prepara account briefs y actualiza el CRM. El harness recupera cuenta, conversaciones, uso, issues y fuentes aprobadas, y entrega tools read-only.
Valida cada call, aplica permisos, registra URLs, compacta investigación y pide approval antes de cambiar una oportunidad o enviar un mensaje.
La primera versión usa Claude Agent SDK. Como estado, memoria, tools y traces siguen contratos propios, después puede probar otro modelo para research sin perder memoria.
Notas de implementación
Separá adapters de modelo, context assembly, memory store, tool registry, policy engine, sandbox, task state, event log, evals y UI.
Comprá cuando importan velocidad, infraestructura, sandboxes y optimizaciones del provider. Construí o usá un harness open cuando model choice, memoria, data residency, ejecución custom u observabilidad son estratégicos.
Medí task success, errores de tools, retries, intervención humana, contexto, retrieval, latencia, costo, denegaciones y performance por modelo. Versioná prompts, tools, políticas y schema de memoria.


