Guardrails: como impedir a IA de prometer o que você não faz
Guardrails pra leigo: os limites que impedem a IA de prometer desconto, prazo ou serviço que sua empresa não oferece — e por que isso é essencial.

O medo de quem coloca IA pra atender não é só "ela vai inventar um preço?". É pior: "ela vai prometer um desconto que eu não dou, um prazo que eu não cumpro, um serviço que eu nem ofereço — e o cliente vai cobrar de mim." Esse medo tem solução, e o nome dela é guardrails. É um conceito quase sem explicação decente em português, então vamos do zero: o que são, por que importam e como você controla o que a IA pode dizer.
TL;DR:
- Guardrails são os limites do que a IA pode e não pode dizer/fazer.
- Sem eles, a IA responde qualquer coisa — e promete o que você não entrega.
- Trabalham junto com o RAG: RAG dá a fonte, guardrail dá o limite.
- A regra de ouro: decisão sensível (desconto, agenda, reclamação) vai pra um humano.
- Você configura em linguagem normal, sem programar.
#O problema: uma IA solta fala demais
Um modelo de linguagem, sozinho, é uma máquina de agradar. Ele quer completar a conversa, ser prestativo, dizer sim. Sem controle, isso vira problema:
- O cliente insiste no desconto, e a IA — pra "ajudar" — oferece 30% que você nunca autorizou.
- Perguntam um prazo de entrega, e a IA chuta "2 dias" pra não deixar a pergunta sem resposta.
- O cliente puxa um assunto fora do escopo, e a IA opina sobre algo que não tem nada a ver com seu negócio.
Cada um desses é uma promessa que você vai ter que honrar ou desmentir — e desmentir queima a relação. A IA solta é simpática demais pro seu próprio bem.
#O que são guardrails (a cerca de proteção)
Guardrail, em inglês, é a defensa metálica na beira da estrada — aquela que impede o carro de sair da pista. É exatamente a imagem certa: guardrails de IA são as cercas que mantêm a IA dentro do que é permitido.
Eles definem, de forma clara:
- O que a IA pode dizer — informações do seu negócio que ela está autorizada a passar.
- O que ela não pode dizer — preços antes da avaliação, descontos não aprovados, prazos que você não garante, assuntos fora do escopo.
- Quando ela deve parar e chamar um humano — nas decisões que exigem julgamento.
A IA continua conversando naturalmente. Ela só não pode atravessar a cerca. Se quiser o conceito curto pra referência, veja guardrails no glossário.
#Guardrails e RAG: dois controles diferentes
Muita gente mistura. São coisas complementares:
| RAG | Guardrails | |
|---|---|---|
| Pergunta que responde | "De onde vem a resposta?" | "O que a IA pode dizer?" |
| O que faz | Busca nos seus dados antes de responder | Define os limites do que é permitido |
| Combate | Invenção de fato (alucinação) | Promessa indevida, assunto fora do escopo |
Um exemplo junta os dois: o cliente pergunta o preço de um serviço. O RAG garante que a IA pegue o valor certo do seu cadastro (e não invente). O guardrail garante que, se a sua regra é "não informar preço antes da avaliação", a IA segure essa informação e conduza pra avaliação — mesmo tendo o número na mão. Um controla a fonte; o outro, a permissão. Falei mais de fundamentação de resposta em o que é RAG.
#Como você define guardrails na prática (sem programar)
A parte boa: num sistema bem-feito, guardrail não é código. É uma lista de instruções em português normal — frases de regra do seu negócio. Por exemplo:
- "Não informar preço antes da avaliação."
- "Confirmar o telefone antes de agendar."
- "Chamar um humano em qualquer reclamação."
- "Não prometer prazo de entrega — dizer que confirma com a equipe."
- "Não oferecer desconto; se o cliente pedir, passar pra um atendente."
Você escreve, a IA passa a seguir. Mudou uma política? Edita a frase. No Unred, isso vive numa área de instruções da IA que você ajusta a qualquer momento — a IA compõe a conversa a partir dessas regras, sem você precisar tocar em nada técnico. Se quiser entender como as instruções guiam o comportamento, veja prompt no glossário.
#O guardrail mais importante: saber a hora de chamar um humano
Aqui está o desenho que faz a diferença. O guardrail mais valioso não é uma frase de "não faça X". É a regra de quando a IA deve parar e passar pra uma pessoa.
Existe respaldo pra isso no comportamento do cliente. Segundo a pesquisa CX Trends (Octadesk/Opinion Box), 63% dos brasileiros consideram essencial poder ser transferidos pra um humano quando necessário (fonte). Uma IA que prende o cliente sem saída queima a relação. Uma que sabe passar o bastão constrói confiança.
No Unred, esses casos vão pra uma bandeja onde um humano decide:
- Desconto ou condição especial acima do autorizado → você aprova.
- Agendar visita/consulta → a IA não sabe da sua agenda real; você confirma.
- Comprovante de pagamento → o sistema não vê o extrato; alguém confere.
- Cliente irritado / ameaça de reclamação → pessoa resolve.
E as duas regras duras que fecham o cerco:
- A venda é sempre confirmação manual. O sistema não detecta pagamento nem fecha venda sozinho. A IA sugere; quem clica em "VENDA" é o atendente.
- O cliente nunca sai do sistema. A IA não empurra o cliente pra número ou link externo — tudo acontece dentro da conversa.
#Por que isso protege sua marca
Sem guardrails, cada conversa da IA é uma aposta. Com guardrails, a IA vira uma funcionária que conhece as regras da casa: fala o que pode, segura o que não pode, e te chama quando é hora de decidir. É a diferença entre confiar a IA com seus clientes e rezar pra ela não fazer besteira.
A pesquisa acadêmica sobre esses sistemas reforça que fundamentar a resposta e impor limites são justamente os caminhos pra tornar a IA confiável em uso real — nenhuma técnica isolada resolve, é a combinação de camadas (fonte).
Se você quer uma IA que atende seus clientes dentro das suas regras — e te chama nas decisões que são suas —, é exatamente esse controle que sustenta uma IA para atendimento no WhatsApp confiável. A IA conversa; você mantém o controle.
#Fontes
- CX Trends (Octadesk/Opinion Box) — 63% consideram essencial poder ser transferidos para um humano: cxtrends.com.br
- Springer (Business & Information Systems Engineering) — Retrieval-Augmented Generation survey (limitações e robustez): link.springer.com
- arXiv — Retrieval-Augmented Generation for Large Language Models: A Survey: arxiv.org
Perguntas frequentes
Guardrails são os limites que você impõe à IA: o que ela pode e não pode dizer ou fazer. É a diferença entre uma IA solta, que responde qualquer coisa, e uma IA que fica dentro das regras do seu negócio — não promete desconto não autorizado, não inventa prazo, não fala de assunto fora do escopo.
Trabalham junto com o RAG. O RAG dá a fonte certa (seus dados) pra IA responder; os guardrails definem os limites do que ela pode dizer, mesmo tendo a informação. Um controla de onde vem a resposta; o outro controla o que ela tem permissão de afirmar. Juntos, reduzem muito o risco de a IA prometer o que você não faz.
Com guardrails que definem os limites de negociação e com o encaminhamento pra um humano nas exceções. No Unred, quando o cliente pede um desconto acima do autorizado, a IA não decide sozinha: ela cria uma tarefa pra você aprovar. A IA sugere; a decisão sensível é sua.
As instruções são parte dos guardrails, mas não tudo. As instruções dizem à IA como agir; guardrails completos incluem também limites técnicos, verificação da resposta e regras de quando parar e chamar um humano. É um conjunto de camadas, não só um texto.
Não deveria. Bons guardrails mantêm a IA dentro do escopo do seu negócio. Se o cliente puxa um assunto fora (opinião política, outro serviço que você não oferece), a IA educadamente traz de volta ou passa pra um humano. Isso protege sua marca de respostas que você nunca autorizaria.
Não num bom sistema. Você define as regras em linguagem normal — 'não informar preço antes da avaliação', 'chamar um humano em reclamações', 'não prometer prazo de entrega'. O sistema traduz isso em limites pra IA. No Unred, isso é uma lista de instruções que você edita a qualquer momento.

Fundador da Unred · Sócio & VP do Inglês 200 Horas
Fundador da Unred, CRM com IA pra WhatsApp. Também é sócio e VP do Inglês 200 Horas (escola de idiomas com 100k+ alunos formados).