Skip to main content
Un guardrail es una política reusable que un owner o admin asigna a un usuario o a una API key. Define presupuesto, modelos y providers permitidos, ZDR por grupo, detección de prompt injection y PII, y patrones de contenido custom. Se administran desde /dashboard/guardrails o desde la API REST.

Componentes

  • Presupuesto — límite USD por periodo (diario/semanal/mensual). Cuando se alcanza, el guardrail bloquea hasta el siguiente reset.
  • Modelos permitidos — lista blanca por model id. Vacío = todos.
  • Providers permitidos — lista blanca por provider id (openai, anthropic, …).
  • ZDR por grupo — toggle independiente por grupo. Mismo concepto que el setting del org pero aplicado por guardrail.
  • Prompt injection detection — regex de patrones comunes (ignore previous instructions, reveal system prompt).
  • PII detectionoff / redact / block. Detecta email, teléfono, RFC, CURP, tarjetas, IPv4.
  • Custom patterns — array de { name, pattern, action }. Regex case-insensitive, action redact o block.

Combinación de varios guardrails

Cuando aplican varios al mismo request:

Forma del bloqueo

El mensaje describe el motivo de alto nivel; no expone la configuración interna ni los nombres de guardrails individuales (evita doxing de política a usuarios sin permiso admin).

API REST

Ejemplo de creación