ADI Platform · Seguridad
Guardrails en código, verificados fuera del modelo
Tres filtros obligatorios, ocho configurables, tres niveles de severidad y traza auditable por turno.
Una instrucción en el prompt no es un control
Pedirle al modelo que no diga algo es una preferencia, no una garantía. El equipo de Riesgos no aprueba un control que el propio sistema controlado puede ignorar.
Por eso los filtros corren antes y después del LLM, en código determinístico, y el modelo no elige la acción final: propone dentro de un catálogo cerrado con enums validados afuera.
Los filtros
Permisivo, moderado y estricto. Los tres obligatorios no se pueden desactivar en ningún agente.
Lo que Riesgos puede reconstruir
Traza por turno
Qué dijo el agente, con qué versión de prompt y de base, y qué filtro actuó.
PII tokenizada en el borde
El dato personal no sale hacia el proveedor de modelo; el log de auditoría registra la interacción sin el dato.
QA de regresión versionada
Cada cambio de comportamiento se prueba contra el conjunto de casos aprobado.
Canary y rollback
Liberación gradual por porcentaje, con vuelta a la versión anterior en un paso.
Aislamiento por organización
Multi-tenant con enforcement en el servidor, no en el cliente.
Despliegue en tu perímetro
VPC dedicada o red privada, cuando la política lo exija.