ADI Platform · Segurança
Guardrails em código, verificados fora do modelo
Três filtros obrigatórios, oito configuráveis, três níveis de severidade e trilha auditável por turno.
Instrução em prompt não é controle
Pedir ao modelo que não diga algo é uma preferência, não uma garantia. O time de Riscos não aprova um controle que o próprio sistema controlado pode ignorar.
Por isso os filtros rodam antes e depois do LLM, em código determinístico, e o modelo não escolhe a ação final: propõe dentro de um catálogo fechado com enums validados fora.
Os filtros
Permissivo, moderado e estrito. Os três obrigatórios não podem ser desativados em nenhum agente.
O que Riscos consegue reconstruir
Trilha por turno
O que o agente disse, com qual versão de prompt e de base, e qual filtro atuou.
PII tokenizada na borda
O dado pessoal não sai para o provedor de modelo; o log de auditoria registra a interação sem o dado.
QA de regressão versionada
Cada mudança de comportamento é testada contra o conjunto de casos aprovado.
Canary e rollback
Liberação gradual por percentual, com volta à versão anterior em um passo.
Isolamento por organização
Multi-tenant com enforcement no servidor, não no cliente.
Deploy no seu perímetro
VPC dedicada ou rede privada, quando a política exigir.