Produto15 de março de 20263 min de leitura

Proteção no Agent Canvas: controles estruturais para agentes de IA

As proteções no Agent Canvas não são instruções imediatas — são restrições rígidas no gráfico de conversação que o LLM não pode ignorar. Veja como eles funcionam.

Quando você diz a um LLM 'nunca forneça aconselhamento médico', você está confiando na conformidade probabilística. Ao adicionar um nó de proteção no Agent Canvas que detecta tópicos médicos e encaminha para um fluxo de escalonamento, você está impondo uma restrição estrutural. A diferença: ocasionalmente falhamos. O outro não pode ser contornado pelo modelo.

Tipos de guarda-corpos

  • Blocos de tópicos — evitam que o agente se envolva em assuntos específicos (preços de concorrentes, diagnóstico médico, aconselhamento jurídico). A detecção acontece na camada de orquestração, não no prompt.
  • Divulgações obrigatórias — injete a linguagem necessária em pontos específicos: divulgação de identidade de IA no início da chamada, linguagem de conformidade antes das transações financeiras, gravação de notificações de consentimento.
  • Gatilhos de escalonamento — transferência humana automática quando as condições são atendidas: solicitações humanas do cliente, sentimento cai abaixo do limite, conversa excede o limite de complexidade.
  • Regras de tratamento de dados — edite informações confidenciais de registros, evite o armazenamento de dados de pagamento e aplique criptografia em nível de campo para PII.
  • Limites de ação — restringe quais ferramentas o agente pode usar e sob quais condições (por exemplo, pode processar reembolsos abaixo de US$ 50 de forma autônoma, deve escalar acima de US$ 50).

Os guarda-corpos são visíveis na tela

Cada guardrail é um nó ou borda visível no gráfico de conversação. As equipes de conformidade podem auditar o fluxo inspecionando a tela — elas podem ver onde as divulgações são injetadas, onde ocorre o escalonamento e quais filtros de tópico estão ativos. Esta auditabilidade é impossível com sistemas imediatos, onde as proteções estão enterradas em parágrafos de instruções em linguagem natural que podem ou não ser seguidas.

Pronto para construir?

Veja como os agentes de IA multimodais da Mazed funcionam para o seu caso de uso.

Proteção no Agent Canvas: controles estruturais para agentes de IA | Mazed Blog | Mazed