Cuando un piloto de agentes no llega a producción, la causa rara vez es el modelo. Es el harness: la capa de andamiaje que rodea al modelo y decide qué herramientas puede usar, con qué permisos, qué recuerda entre pasos, qué ocurre cuando algo falla y cuánto puede gastar antes de que alguien lo pare.
El modelo es un componente que se puede sustituir en una tarde. El harness es el producto.
Qué hay dentro de un harness
Definición de herramientas. Cada acción que el agente puede ejecutar —consultar el ERP, crear un pedido, enviar un correo— se describe con precisión: qué hace, qué parámetros acepta, qué devuelve y qué efectos tiene. Una descripción ambigua produce un agente que usa la herramienta equivocada y lo hace con seguridad.
Permisos y ámbito. Lectura y escritura separadas, credenciales acotadas al mínimo necesario y una lista explícita de lo que el agente no puede tocar. El principio es el mismo que con cualquier empleado nuevo: acceso al sistema, sí; acceso a todo el sistema, no.
Memoria y contexto. Qué se le pasa al modelo en cada paso, qué se resume, qué se persiste entre ejecuciones y qué se descarta. Un agente que arrastra todo el histórico se vuelve caro y confuso; uno que no recuerda nada repite trabajo y pierde el hilo.
Reintentos y recuperación. Qué se hace cuando una herramienta devuelve un error, cuando el modelo entrega algo que no se puede interpretar o cuando una llamada externa se cae. Reintento con espera creciente, ruta alternativa o escalado a una persona.
Puntos de aprobación humana. Las acciones irreversibles —pagar, borrar, comunicar a un cliente— se paran y esperan confirmación. El resto fluye. Definir bien esa frontera es una decisión de negocio, no técnica.
Límites de gasto y de pasos. Un tope por ejecución y otro por día. Sin ellos, un bucle que nadie previó consume el presupuesto de un trimestre en una noche.
Trazas. Cada ejecución deja registro de qué decidió el agente, con qué información y con qué resultado. Sin trazas no hay depuración posible ni defensa ante una auditoría.
Por qué el harness es donde se gana o se pierde
Un agente sin harness funciona en la demostración porque la demostración la conduce quien lo construyó. En producción se encuentra con datos sucios, sistemas que responden tarde, casos que nadie contempló y usuarios que piden cosas raras. Todo eso lo absorbe el harness o no lo absorbe nadie.
Es también lo que permite cambiar de modelo sin rehacer el proyecto. Con el andamiaje bien montado, sustituir el modelo que hay detrás es una línea de configuración y una campaña de evaluación; sin él, es empezar de cero.
Cuándo tiene sentido invertir en harness propio — y cuándo no
Tiene sentido cuando:
- El agente va a ejecutar acciones reales sobre sistemas de la empresa, no solo redactar texto
- Hay más de un caso de uso previsto: el harness se amortiza a partir del segundo agente
- El proceso toca datos sensibles o decisiones con consecuencias económicas
- Se quiere conservar la libertad de cambiar de proveedor de modelo
No tiene sentido cuando:
- El caso de uso se resuelve con una automatización clásica o un flujo de n8n
- Es una prueba de concepto para decidir si merece la pena seguir: primero se valida el valor, después se industrializa
- No hay quien mantenga el sistema después: un harness sin dueño se degrada en meses
Cómo lo abordamos
Empezamos por el inventario de acciones que el agente necesitará ejecutar y por la frontera de riesgo: qué puede hacer solo y qué requiere una firma humana. A partir de ahí se define el conjunto de herramientas, los permisos, los topes de gasto y el protocolo de errores. La evaluación se monta antes que el agente, no después: sin una forma de medir si funciona, no hay manera de saber si un cambio mejora o empeora.
En Asturias el listón lo ponen la siderurgia de Gijón y Avilés y las plantas del sector lácteo: entornos donde una escritura mal hecha en el sistema de producción o de trazabilidad tiene consecuencias inmediatas, y donde la frontera entre lo que el agente hace solo y lo que requiere firma se decide en el comité de operaciones, no en el equipo técnico.
Como laboratorio independiente, no revendemos plataformas de agentes. Si el caso se resuelve con una herramienta de mercado, lo decimos.
Preguntas frecuentes sobre harness de agentes
¿Un harness es lo mismo que un framework de agentes? No. Un framework aporta piezas; el harness es la decisión de cómo se ensamblan para tu caso: qué herramientas existen, qué permisos tienen, dónde se para el agente y cuánto puede gastar. Se puede construir sobre un framework o sin él.
¿Se puede reutilizar entre agentes distintos? Esa es la idea. El coste alto es el primero; a partir del segundo agente se reaprovechan las herramientas, los permisos, las trazas y los límites.
¿Cuánto encarece el proyecto? Es la mayor parte del trabajo real de un proyecto de agentes. Presentarlo como un extra opcional es lo que lleva a los pilotos que nunca salen de la demostración.