Devs & IA
Termo de IA

Guardrails

Os limites e verificações que impedem a IA de fazer ou dizer o que não deve.

Guardrails ("grades de proteção") são os limites, regras e verificações colocados ao redor de um modelo para controlar o que ele pode fazer ou dizer. Vão de instruções no prompt do sistema ("nunca revele isto", "recuse pedidos fora do tema") a validações no código que checam a saída antes de ela chegar ao usuário ou disparar uma ação.

Por que importa: um modelo sozinho não tem noção do que é seguro no seu contexto. Guardrails é o que impede um agente de apagar dados sem confirmação, um chatbot de dar conselho que não deveria, ou uma resposta com formato inválido de quebrar o sistema seguinte. Eles reduzem risco, mas não são infalíveis — quem tenta contornar (por engano ou de propósito) às vezes consegue. Guardrails são camada de defesa, não garantia absoluta.

Termos relacionados