InicioAgentes de IAComo melhorar as respostas do agente

Como melhorar as respostas do agente


Nenhum agente sai perfeito da primeira configuração. Ele vai responder longo demais, esquecer o que foi combinado, usar um tom que não combina com a sua marca. Isso é normal — e é resolvido ajustando três coisas: o texto das instruções, os parâmetros de resposta e as ferramentas ligadas.

Este artigo mostra o que ajustar em cada situação.


Comece pelo diagnóstico, não pelo ajuste

Antes de mexer em qualquer coisa, leia as conversas que o agente atendeu. É o único jeito de saber o que está errado de verdade.

  • Abra as conversas em Atendimento → Conversas e leia como se você fosse o cliente.
  • Anote os pontos em que a resposta não foi boa.
  • Para cada um, pergunte: faltou informação, faltou regra ou faltou ferramenta?

Essa pergunta já indica onde ajustar:

  • Faltou informação — o agente não sabia o preço, o prazo, a condição. Vai nas instruções ou na base de conhecimento.
  • Faltou regra — ele sabia, mas se comportou de um jeito que você não queria. Vai nas instruções.
  • Faltou ferramenta — ele deveria ter feito algo no sistema e não fez. Ferramenta desligada, ou ligada sem instrução.
  • Nada disso — o comportamento é geral demais: sempre longo, sempre criativo, sempre esquecido. Aí é parâmetro.

O prompt é onde estão 80% dos ajustes

A maior parte dos problemas de comportamento se resolve no texto das instruções, não nos controles numéricos. Vale insistir nisso porque é comum a pessoa mexer nos parâmetros primeiro e não resolver nada.

Corrija com regra, não com exemplo

Quando encontrar uma resposta ruim, escreva a regra que faltou — e não a resposta que você queria naquele caso.

  • Regra: “Se o cliente pedir desconto, explique que os preços são fixos e ofereça as opções mais em conta.” Isso resolve dezenas de conversas diferentes.
  • Exemplo: “Se o cliente pedir 10% de desconto, responda que não temos.” Isso resolve uma conversa só, e o prompt vai inchando sem melhorar.

Prompt que cresce a cada problema é sinal de que os ajustes estão sendo feitos por exemplo. Vale reler de tempos em tempos e substituir vários casos específicos por uma regra que cubra todos.

Mude uma coisa por vez

Se você reescrever o prompt inteiro de uma vez e a conversa melhorar, você não sabe o que resolveu. E se piorar, não sabe o que desfazer.

Teste com a mesma conversa

Depois de cada ajuste, repita o mesmo caminho de conversa que deu errado antes. Use outro número, nunca o mesmo que está conectado.


Os três parâmetros de resposta

Ficam na aba Início do agente, logo abaixo da configuração de IA. Os valores padrão funcionam bem — mexa neles quando o comportamento for consistente, não quando for um caso isolado.

Sensibilidade (temperatura)

Vai de 0 a 2 e controla o quanto o agente improvisa. Perto de 0 ele é previsível e repetitivo. Perto de 2 ele varia muito e inventa mais.

Para atendimento, fique entre 0,4 e 0,8.

  • Baixe se o agente estiver criando informação que não existe, mudando preço ou saindo do roteiro.
  • Suba um pouco se ele estiver soando robótico e repetindo as mesmas frases feitas.

Baixar a temperatura reduz a invenção, mas não elimina. Se o agente inventa preço, o problema também é falta de informação: o catálogo precisa estar completo e o prompt precisa proibir explicitamente.

Máximo de tokens de saída

Vai de 50 a 4000 e limita o tamanho de cada resposta. Um token é mais ou menos um pedaço de palavra.

Este é o parâmetro mais mal usado. Quem quer respostas curtas costuma baixar esse número — e o resultado é a frase sendo cortada no meio. O jeito certo de encurtar é pedir no prompt: “mensagens curtas, um assunto por vez, sem textão”.

Use o limite alto e controle o tamanho pelo prompt. Se as respostas estiverem sendo truncadas, aumente.

Máximo de mensagens no histórico

Quantas mensagens recentes o agente relê antes de responder. É a memória dele dentro da conversa. O recomendado é 20.

  • Baixo demais — ele esquece o que foi combinado e repete perguntas já respondidas.
  • Alto demais — a memória melhora, mas cada mensagem fica mais cara, porque todo esse histórico é reenviado à IA a cada resposta.

Se o agente repete pergunta mesmo com 20 no histórico, o problema é o prompt: acrescente que ele nunca deve pedir uma informação que o cliente já deu na conversa.


As ferramentas também precisam de ajuste

Ferramenta não é só ligar e esquecer. Duas coisas ficam desalinhadas com o tempo:

Ferramenta ligada sem instrução

O agente tem a permissão mas nunca usa, porque nada no prompt diz quando. É o problema mais comum de todos, e não aparece como erro — a ação simplesmente não acontece.

Confira: para cada ferramenta ligada, existe uma frase no prompt dizendo em que situação usá-la?

Ferramenta ligada que ninguém usa

O contrário também atrapalha. Cada ferramenta ativa injeta instruções no agente a cada mensagem — o que deixa a resposta mais lenta, mais cara e o agente menos focado.

Se você ligou tudo “por garantia”, desligue o que aquele agente não usa. A economia é real e a qualidade da resposta melhora, porque ele tem menos coisa para considerar antes de responder.

Instrução vaga na ferramenta

Instruções genéricas produzem uso errático. Compare:

  • Vago: “marque o cliente com tag quando fizer sentido”
  • Claro: “quando o cliente demonstrar interesse real de compra, marque com a tag Lead Quente; se disser que é revendedor, marque com a tag Revenda”

Roteiro de ajuste por sintoma

Os problemas mais frequentes e onde mexer em cada um:

Inventa produto, preço ou promoção

Baixe a sensibilidade. Confira se a informação está completa no prompt ou no catálogo. Acrescente a proibição explícita: “não invente itens, preços ou promoções”.

Manda textão

Peça no prompt mensagens curtas e um assunto por vez. Não baixe os tokens de saída — isso trunca a frase.

Repete pergunta já respondida

Aumente o histórico para 20. Se já estiver em 20, acrescente a regra no prompt.

Soa robótico

Suba um pouco a sensibilidade e detalhe o tom no prompt: como ele fala, que tipo de expressão usa, se pode usar emoji e quanto.

Pula etapas ou muda a ordem das perguntas

Escreva a sequência numerada no prompt, na ordem exata em que os assuntos devem aparecer.

Conta ao cliente o que fez no sistema

Acrescente a regra: “nunca informe ao cliente que executou uma ação interna — apenas continue a conversa naturalmente”.

Diz que fez algo mas não fez

Acrescente: “nunca diga que fez algo se não usou a ferramenta correspondente”. Esse erro é grave porque o cliente fica esperando um retorno que não vem.

Não executa a ação que você esperava

Confira se a ferramenta está ligada e se o prompt diz quando usá-la. São duas coisas separadas.

Promete o que não pode cumprir

Liste no prompt o que ele não faz — desconto, alteração de prazo, item fora do catálogo — e o que fazer nesses casos, normalmente transferir para uma pessoa.

Não transfere quando deveria

Seja específico sobre a situação: “se o cliente pedir para falar com uma pessoa, ou se a dúvida sair do que você sabe resolver, transfira para a fila Suporte”.


Um ciclo de ajuste que funciona

  1. Leia cinco a dez conversas reais do agente.
  2. Anote os pontos ruins e classifique cada um: informação, regra, ferramenta ou parâmetro.
  3. Ajuste um item — o mais frequente da lista.
  4. Teste refazendo a conversa que deu errado.
  5. Volte a ler as conversas novas alguns dias depois.

Nas primeiras semanas vale repetir esse ciclo com frequência. Depois que o agente estabiliza, uma revisão a cada mês costuma bastar — e é uma boa hora para olhar também o consumo de crédito.


Perguntas frequentes

Mexo primeiro no prompt ou nos parâmetros?
No prompt, quase sempre. Os parâmetros resolvem comportamentos gerais — criatividade, tamanho, memória. Tudo que é específico do seu negócio é prompt.

Mudei o prompt e não vi diferença.
Confira se salvou o agente, e se está testando a mesma coisa. Vale também simplificar: instruções muito longas ou contraditórias fazem o agente ignorar partes.

Posso ter instruções que se contradizem?
Pode acontecer sem você perceber, principalmente em prompt que cresceu aos poucos. Se o comportamento está inconsistente, releia o texto inteiro procurando regras que brigam entre si.

Qual sensibilidade usar?
Entre 0,4 e 0,8 para atendimento. Abaixo disso fica repetitivo, acima começa a inventar.

Aumentar o histórico deixa o agente mais caro?
Sim. Todo o histórico é reenviado à IA a cada resposta. Vinte mensagens é o equilíbrio entre memória e custo.

Como sei se o problema é o modelo escolhido?
Se o agente erra em situações que exigem raciocínio — interpretar um pedido confuso, lidar com exceção — vale testar um modelo maior. Mas ajuste o prompt primeiro: modelo maior com instrução ruim continua errando, só mais caro.

Este artigo foi útil para você?

Seja o primeiro a avaliar este artigo