Nenhum agente sai perfeito da primeira configuração. Ele vai responder longo demais, esquecer o que foi combinado, usar um tom que não combina com a sua marca. Isso é normal — e é resolvido ajustando três coisas: o texto das instruções, os parâmetros de resposta e as ferramentas ligadas.
Este artigo mostra o que ajustar em cada situação.
Comece pelo diagnóstico, não pelo ajuste
Antes de mexer em qualquer coisa, leia as conversas que o agente atendeu. É o único jeito de saber o que está errado de verdade.
- Abra as conversas em Atendimento → Conversas e leia como se você fosse o cliente.
- Anote os pontos em que a resposta não foi boa.
- Para cada um, pergunte: faltou informação, faltou regra ou faltou ferramenta?
Essa pergunta já indica onde ajustar:
- Faltou informação — o agente não sabia o preço, o prazo, a condição. Vai nas instruções ou na base de conhecimento.
- Faltou regra — ele sabia, mas se comportou de um jeito que você não queria. Vai nas instruções.
- Faltou ferramenta — ele deveria ter feito algo no sistema e não fez. Ferramenta desligada, ou ligada sem instrução.
- Nada disso — o comportamento é geral demais: sempre longo, sempre criativo, sempre esquecido. Aí é parâmetro.
O prompt é onde estão 80% dos ajustes
A maior parte dos problemas de comportamento se resolve no texto das instruções, não nos controles numéricos. Vale insistir nisso porque é comum a pessoa mexer nos parâmetros primeiro e não resolver nada.
Corrija com regra, não com exemplo
Quando encontrar uma resposta ruim, escreva a regra que faltou — e não a resposta que você queria naquele caso.
- Regra: “Se o cliente pedir desconto, explique que os preços são fixos e ofereça as opções mais em conta.” Isso resolve dezenas de conversas diferentes.
- Exemplo: “Se o cliente pedir 10% de desconto, responda que não temos.” Isso resolve uma conversa só, e o prompt vai inchando sem melhorar.
Prompt que cresce a cada problema é sinal de que os ajustes estão sendo feitos por exemplo. Vale reler de tempos em tempos e substituir vários casos específicos por uma regra que cubra todos.
Mude uma coisa por vez
Se você reescrever o prompt inteiro de uma vez e a conversa melhorar, você não sabe o que resolveu. E se piorar, não sabe o que desfazer.
Teste com a mesma conversa
Depois de cada ajuste, repita o mesmo caminho de conversa que deu errado antes. Use outro número, nunca o mesmo que está conectado.
Os três parâmetros de resposta
Ficam na aba Início do agente, logo abaixo da configuração de IA. Os valores padrão funcionam bem — mexa neles quando o comportamento for consistente, não quando for um caso isolado.
Sensibilidade (temperatura)
Vai de 0 a 2 e controla o quanto o agente improvisa. Perto de 0 ele é previsível e repetitivo. Perto de 2 ele varia muito e inventa mais.
Para atendimento, fique entre 0,4 e 0,8.
- Baixe se o agente estiver criando informação que não existe, mudando preço ou saindo do roteiro.
- Suba um pouco se ele estiver soando robótico e repetindo as mesmas frases feitas.
Baixar a temperatura reduz a invenção, mas não elimina. Se o agente inventa preço, o problema também é falta de informação: o catálogo precisa estar completo e o prompt precisa proibir explicitamente.
Máximo de tokens de saída
Vai de 50 a 4000 e limita o tamanho de cada resposta. Um token é mais ou menos um pedaço de palavra.
Este é o parâmetro mais mal usado. Quem quer respostas curtas costuma baixar esse número — e o resultado é a frase sendo cortada no meio. O jeito certo de encurtar é pedir no prompt: “mensagens curtas, um assunto por vez, sem textão”.
Use o limite alto e controle o tamanho pelo prompt. Se as respostas estiverem sendo truncadas, aumente.
Máximo de mensagens no histórico
Quantas mensagens recentes o agente relê antes de responder. É a memória dele dentro da conversa. O recomendado é 20.
- Baixo demais — ele esquece o que foi combinado e repete perguntas já respondidas.
- Alto demais — a memória melhora, mas cada mensagem fica mais cara, porque todo esse histórico é reenviado à IA a cada resposta.
Se o agente repete pergunta mesmo com 20 no histórico, o problema é o prompt: acrescente que ele nunca deve pedir uma informação que o cliente já deu na conversa.
As ferramentas também precisam de ajuste
Ferramenta não é só ligar e esquecer. Duas coisas ficam desalinhadas com o tempo:
Ferramenta ligada sem instrução
O agente tem a permissão mas nunca usa, porque nada no prompt diz quando. É o problema mais comum de todos, e não aparece como erro — a ação simplesmente não acontece.
Confira: para cada ferramenta ligada, existe uma frase no prompt dizendo em que situação usá-la?
Ferramenta ligada que ninguém usa
O contrário também atrapalha. Cada ferramenta ativa injeta instruções no agente a cada mensagem — o que deixa a resposta mais lenta, mais cara e o agente menos focado.
Se você ligou tudo “por garantia”, desligue o que aquele agente não usa. A economia é real e a qualidade da resposta melhora, porque ele tem menos coisa para considerar antes de responder.
Instrução vaga na ferramenta
Instruções genéricas produzem uso errático. Compare:
- Vago: “marque o cliente com tag quando fizer sentido”
- Claro: “quando o cliente demonstrar interesse real de compra, marque com a tag Lead Quente; se disser que é revendedor, marque com a tag Revenda”
Roteiro de ajuste por sintoma
Os problemas mais frequentes e onde mexer em cada um:
Inventa produto, preço ou promoção
Baixe a sensibilidade. Confira se a informação está completa no prompt ou no catálogo. Acrescente a proibição explícita: “não invente itens, preços ou promoções”.
Manda textão
Peça no prompt mensagens curtas e um assunto por vez. Não baixe os tokens de saída — isso trunca a frase.
Repete pergunta já respondida
Aumente o histórico para 20. Se já estiver em 20, acrescente a regra no prompt.
Soa robótico
Suba um pouco a sensibilidade e detalhe o tom no prompt: como ele fala, que tipo de expressão usa, se pode usar emoji e quanto.
Pula etapas ou muda a ordem das perguntas
Escreva a sequência numerada no prompt, na ordem exata em que os assuntos devem aparecer.
Conta ao cliente o que fez no sistema
Acrescente a regra: “nunca informe ao cliente que executou uma ação interna — apenas continue a conversa naturalmente”.
Diz que fez algo mas não fez
Acrescente: “nunca diga que fez algo se não usou a ferramenta correspondente”. Esse erro é grave porque o cliente fica esperando um retorno que não vem.
Não executa a ação que você esperava
Confira se a ferramenta está ligada e se o prompt diz quando usá-la. São duas coisas separadas.
Promete o que não pode cumprir
Liste no prompt o que ele não faz — desconto, alteração de prazo, item fora do catálogo — e o que fazer nesses casos, normalmente transferir para uma pessoa.
Não transfere quando deveria
Seja específico sobre a situação: “se o cliente pedir para falar com uma pessoa, ou se a dúvida sair do que você sabe resolver, transfira para a fila Suporte”.
Um ciclo de ajuste que funciona
- Leia cinco a dez conversas reais do agente.
- Anote os pontos ruins e classifique cada um: informação, regra, ferramenta ou parâmetro.
- Ajuste um item — o mais frequente da lista.
- Teste refazendo a conversa que deu errado.
- Volte a ler as conversas novas alguns dias depois.
Nas primeiras semanas vale repetir esse ciclo com frequência. Depois que o agente estabiliza, uma revisão a cada mês costuma bastar — e é uma boa hora para olhar também o consumo de crédito.
Perguntas frequentes
Mexo primeiro no prompt ou nos parâmetros?
No prompt, quase sempre. Os parâmetros resolvem comportamentos gerais — criatividade, tamanho, memória. Tudo que é específico do seu negócio é prompt.
Mudei o prompt e não vi diferença.
Confira se salvou o agente, e se está testando a mesma coisa. Vale também simplificar: instruções muito longas ou contraditórias fazem o agente ignorar partes.
Posso ter instruções que se contradizem?
Pode acontecer sem você perceber, principalmente em prompt que cresceu aos poucos. Se o comportamento está inconsistente, releia o texto inteiro procurando regras que brigam entre si.
Qual sensibilidade usar?
Entre 0,4 e 0,8 para atendimento. Abaixo disso fica repetitivo, acima começa a inventar.
Aumentar o histórico deixa o agente mais caro?
Sim. Todo o histórico é reenviado à IA a cada resposta. Vinte mensagens é o equilíbrio entre memória e custo.
Como sei se o problema é o modelo escolhido?
Se o agente erra em situações que exigem raciocínio — interpretar um pedido confuso, lidar com exceção — vale testar um modelo maior. Mas ajuste o prompt primeiro: modelo maior com instrução ruim continua errando, só mais caro.