/dashboard/guardrails o desde la API REST.
Componentes
- Presupuesto — límite USD por periodo (diario/semanal/mensual). Cuando se alcanza, el guardrail bloquea hasta el siguiente reset.
- Modelos permitidos — lista blanca por
model id. Vacío = todos. - Providers permitidos — lista blanca por provider id (
openai,anthropic, …). - ZDR por grupo — toggle independiente por grupo. Mismo concepto que el setting del org pero aplicado por guardrail.
- Prompt injection detection — regex de patrones comunes (
ignore previous instructions,reveal system prompt). - PII detection —
off/redact/block. Detecta email, teléfono, RFC, CURP, tarjetas, IPv4. - Custom patterns — array de
{ name, pattern, action }. Regex case-insensitive, actionredactoblock.
Combinación de varios guardrails
Cuando aplican varios al mismo request:Forma del bloqueo
El mensaje describe el motivo de alto nivel; no expone la configuración interna ni los nombres de guardrails individuales (evita doxing de política a usuarios sin permiso admin).