Guardrails en n8n para Agentes de IA (Guarda Railes)

De qué va: Cómo proteger un agente para que no responda lo que no debe, usando el nodo de Guardrails de n8n. Parte de casos reales de bots públicos manipulados.

Highlights:

  • Dónde y cómo: se coloca justo antes del agente. Dos operaciones: Check Text for Violations (valida con salidas Pass/Fail) y Sanitize Text (modifica el mensaje).
  • Cuidado con las variables: tras insertar el guardrail, el agente debe leer guardrailsInput, no chatInput (error típico de “prompt no especificado”).
  • Aplícalo en la rama del paciente: menos restricción para el dueño/fisio, máxima para desconocidos.
  • Tipos: Keywords, NSFW (usa un chat model como juez + threshold), Jailbreak, PII (tarjetas, cripto, IBAN, emails), URLs y Topic/Business Scope.
  • Prompts personalizables: el system message del moderador se puede reescribir o traducir; puedes usar GPT para redactar el Business Scope.
  • Sanitize Text: usa reglas (no IA). Sustituye datos sensibles (un email por “email address”), NIF/NIE, ubicación, secret keys, URLs. Si falla por formato, aplica JSON.stringify.

Idea clave: con guardrails controlas qué información entra y evitas que el agente se vaya por las ramas.