Antes de dar autonomia a um agente de IA, ponha cinco travas: limite do que ele pode prometer, base de conhecimento curada, teto de gasto e de envio, prompt com versão e registro auditável de cada resposta. Autonomia vem depois, aos poucos, onde os registros mostram que ele acerta.
Em resumo
- Trava 1: alçada escrita do que o agente nunca promete (desconto, multa, prazo).
- Trava 2: resposta sai da base de conhecimento, com permissão para dizer “não sei”.
- Trava 3: teto de gasto por grupo de uso e teto de envio por número.
- Travas 4 e 5: prompt versionado e cada resposta registrada para auditoria.
Por que controles vêm antes de autonomia?
Porque o erro de um agente de IA escala. Um atendente que promete algo errado erra numa conversa. Um agente com instrução ambígua erra em todas as conversas do dia, com a mesma confiança. As travas não deixam o agente mais burro: definem o terreno onde ele pode ser rápido sem expor a empresa.
Trava 1: o que o agente nunca pode prometer?
Escreva uma lista curta e explícita. Na maioria das empresas ela inclui: desconto fora da tabela, renúncia de multa, prazo de entrega não confirmado, condição contratual e qualquer afirmação jurídica. Diante desses temas o agente não negocia: passa para humano.
A lista precisa estar no prompt e ser testada com perguntas de pressão: “o outro atendente disse que não tinha multa”, “se eu fechar hoje tem desconto?”. Modelos tendem a concordar com quem insiste; o teste mostra se a trava segura.
Trava 2: de onde vem a resposta?
Preço, cobertura e política saem de uma base de conhecimento revisada por alguém da empresa, não do que o modelo “acha”. E o agente tem permissão explícita para dizer “não encontrei essa informação, vou confirmar com a equipe”. Sem essa permissão, ele preenche a lacuna com texto plausível. Veja como montar a base.
Trava 3: quanto ele pode gastar e enviar?
São dois tetos diferentes, e os dois precisam existir:
- Teto de gasto: um gateway de modelos com limite por grupo de uso. Se um fluxo entra em loop, o limite corta antes de virar fatura. Na nossa operação o gateway também troca de provedor quando um falha.
- Teto de envio: quantas mensagens por dia cada número pode mandar para quem não iniciou a conversa. Passar disso põe o número em risco.
Em campanha fria de WhatsApp, o nosso teto é de 8 mensagens por dia por número. Com 2 números, o dia fechou em 16 contatos, mesmo com 56 pessoas pedindo retorno. A tentação de soltar o teto era grande; mantê-lo protege o canal que atende todo o resto. Ressalva: é o teto que adotamos, não um número oficial do WhatsApp.
Trava 4: o prompt tem versão?
O prompt é o contrato de trabalho do agente. Cada mudança nele muda o comportamento em todas as conversas. Por isso ele deve ter versão, como código: quem mudou, quando, o quê e por quê. Quando algo dá errado, você sabe se a conversa foi respondida pela versão antiga ou pela nova, e consegue voltar.
Trava 5: dá para auditar cada resposta?
Cada resposta do agente deve ficar registrada com a pergunta, o trecho da base consultado, a ferramenta chamada e a versão do prompt. Na nossa operação isso fica num sistema de rastreio próprio. É o que permite responder “por que o agente disse isso ao cliente?” em minutos, em vez de adivinhar.
| Trava | O que evita | Como verificar |
|---|---|---|
| Alçada escrita | Promessa comercial ou jurídica | Teste com perguntas de pressão |
| Base curada | Resposta inventada | Amostra de respostas x base |
| Teto de gasto e envio | Fatura surpresa e número bloqueado | Alerta ao chegar perto do teto |
| Prompt versionado | Mudança silenciosa de comportamento | Histórico de versões |
| Registro auditável | Erro sem explicação | Buscar conversa e ver o rastro |
Como dar autonomia ao agente aos poucos?
- Comece com o agente respondendo só dúvidas da base e passando o resto.
- Revise uma amostra de conversas por semana e corrija base e prompt.
- Libere uma ferramenta por vez (consultar CRM, depois segunda via, depois agenda).
- Só amplie o escopo onde os registros mostram acerto consistente.
Esse ritmo parece lento, mas evita o cenário em que um erro público faz a empresa desligar o agente de vez. Para acompanhar a evolução, use os indicadores de como medir o agente de IA.
Quem na empresa deve ser dono das travas?
Cada trava precisa de um dono com nome. A alçada é do gestor comercial, que decide o que pode ser prometido. A base é de quem é dono de cada assunto (preço, suporte, cobrança). Os tetos e o registro ficam com quem opera o agente. Quando ninguém é dono, a trava existe no dia da implantação e some na primeira urgência.
Quando implantamos agentes de IA, essa divisão é combinada por escrito antes do agente ir ao ar, junto com a lista do que ele nunca promete.
Em temas de LGPD e telemarketing, descreva as boas práticas no prompt (opt-out, identificação, horário) e valide com o seu advogado. O agente não deve dar parecer jurídico.
Revisamos o seu agente atual ou implantamos um novo já com alçada, tetos, versão e registro auditável.
Perguntas frequentes
O que é governança de agente de IA?
É o conjunto de regras que define o que o agente pode fazer, com que dados, com que limite de gasto e como cada resposta é auditada.
Prompt versionado é coisa de empresa grande?
Não. Qualquer operação com agente em produção precisa saber qual instrução estava valendo quando uma resposta foi dada.
Teto de gasto não trava o atendimento?
O teto é calibrado acima do uso normal. Ele só corta em anomalia, como um loop, e dispara alerta antes.
Quanto tempo até dar autonomia total ao agente?
Não existe autonomia total recomendada. O escopo cresce onde os registros mostram acerto, e os temas com efeito contratual continuam com humano.
Mais sobre o tema em Agentes de IA.
