Guardrails en n8n para Agentes de IA (Guarda Railes)
De qué va: Cómo proteger un agente para que no responda lo que no debe, usando el nodo de Guardrails de n8n. Parte de casos reales de bots públicos manipulados.
Highlights:
- Dónde y cómo: se coloca justo antes del agente. Dos operaciones: Check Text for Violations (valida con salidas Pass/Fail) y Sanitize Text (modifica el mensaje).
- Cuidado con las variables: tras insertar el guardrail, el agente debe leer
guardrailsInput, nochatInput(error típico de “prompt no especificado”). - Aplícalo en la rama del paciente: menos restricción para el dueño/fisio, máxima para desconocidos.
- Tipos: Keywords, NSFW (usa un chat model como juez + threshold), Jailbreak, PII (tarjetas, cripto, IBAN, emails), URLs y Topic/Business Scope.
- Prompts personalizables: el system message del moderador se puede reescribir o traducir; puedes usar GPT para redactar el Business Scope.
- Sanitize Text: usa reglas (no IA). Sustituye datos sensibles (un email por “email address”), NIF/NIE, ubicación, secret keys, URLs. Si falla por formato, aplica
JSON.stringify.
Idea clave: con guardrails controlas qué información entra y evitas que el agente se vaya por las ramas.