Não existe preço único. O custo de uma IA de atendimento no WhatsApp tem duas partes: a montagem inicial, que é levantar o procedimento, escrever o prompt, ligar as ferramentas e testar, e o custo mensal, que se divide em servidor, número de WhatsApp, consumo do modelo e manutenção humana. Na Netzach, isso entra no pacote a partir de R$ 1.297 por mês.
A montagem inicial é o que quase ninguém coloca na conta
Quem pergunta quanto custa um agente de IA no WhatsApp quase sempre está perguntando pela mensalidade. Só que a maior parte do trabalho acontece antes da primeira mensagem.
Montar um agente é, na ordem: sentar com quem atende hoje e escrever o procedimento que está na cabeça dessa pessoa, virar isso num prompt de sistema com papel, contexto do negócio, regras e exemplos de conversa modelo, ligar as ferramentas que ele vai chamar, e testar em conversa real antes de soltar.
Cada um desses itens é hora de gente. O prompt é o mais mal compreendido: não é um parágrafo pedindo para a IA ser simpática. Prompt sem exemplo de conversa modelo se comporta pior, e a gente já refez prompt inteiro porque faltava mostrar ao modelo como uma conversa boa termina.
As ferramentas são a outra fatia. O agente não sabe agendar, ele chama uma ferramenta. Buscar janelas livres na agenda, criar agendamento, cancelar, mexer no card do funil, escalar para humano, enviar foto de catálogo. Cada ferramenta dessas é um subfluxo que precisa ser construído e testado. É aí que mora a diferença entre chatbot e agente: o chatbot responde, o agente executa.
O custo mensal se divide em quatro linhas
Depois que está no ar, o gasto recorrente se organiza assim:
| Linha de custo | O que é | O que faz variar |
|---|---|---|
| Servidor | Onde o orquestrador e o banco de histórico rodam | Conversas simultâneas e quanto de histórico você guarda |
| Número de WhatsApp | A caixa de atendimento conectada ao número | Tipo de conexão e volume de conversas iniciadas |
| Consumo do modelo | Cobrado pelo volume de texto que entra e sai | Volume de conversa e tamanho do histórico enviado junto |
| Manutenção humana | Alguém lendo execução e ajustando prompt | Mudança no serviço, na agenda ou no time |
Servidor e número são as linhas mais previsíveis. Modelo e manutenção são as que surpreendem.
Por que o consumo do modelo nunca é fixo
Duas coisas mexem nessa conta. A primeira é óbvia: mais conversa, mais consumo. A segunda quase ninguém explica: o custo sobe com o tamanho do histórico.
Um agente sem memória cumprimenta a mesma pessoa toda vez, pergunta o nome de novo, esquece o que já foi combinado. Para não fazer isso, ele recebe o histórico da conversa a cada mensagem. A gente guarda esse histórico em banco, chaveado pelo telefone, com janela de contexto de 50 mensagens. Isso resolve a memória e é o que faz uma conversa longa custar mais que uma curta.
Tem um detalhe nessa conta que é invisível para quem usa. Pessoa no WhatsApp não escreve parágrafo. Ela manda "oi", depois "tudo bem?", depois "queria saber o preço", em três mensagens seguidas. Sem tratamento, isso dispara três execuções ao mesmo tempo e o agente responde três vezes, atropelando a si mesmo. A solução que a gente roda: toda mensagem entra numa fila, o fluxo espera 16 segundos e checa se aquela ainda é a última. Se não for, descarta: uma execução mais nova assumiu. Se for, processa tudo junto, como se fosse uma mensagem só. É a diferença entre parecer gente e parecer robô travado.
Manutenção não é opcional, porque agente falha em silêncio
Essa é a linha que o cliente mais quer cortar e a que menos deveria.
Num agente nosso em produção, o filtro que verifica se o agente está ativo para aquela conversa estava com a condição invertida. Resultado: bloqueava 100% das mensagens. E o pior é como isso aparece por fora. O fluxo executava normalmente, o painel mostrava execução acontecendo, nada dava erro vermelho. Simplesmente nenhuma mensagem chegava ao modelo. Ficou assim até alguém sentar e ler execução por execução.
Servidor caindo você percebe. Agente de IA quebrado continua parecendo vivo. Já vimos também o agente criar o mesmo agendamento duas vezes porque não entendia que já tinha criado, o que só sumiu quando isso ficou explícito no prompt. E busca de agenda vazia travando o fluxo inteiro, porque o nó parava quando não voltava nenhum horário.
Por isso a gente nunca solta agente novo direto no número. A conversa recebe uma etiqueta de teste e o agente só responde depois de um comando de ativação que a gente digita. Dá para testar em conversa real sem risco de responder o cliente errado.
O que você está comprando, e o que continua sendo seu
Na Netzach, agente de atendimento entra no mesmo modelo do resto: valor fixo, a partir de R$ 1.297 por mês, nunca percentual sobre a verba, e sem fidelidade. Se quiser encerrar, é aviso de 30 dias, sem multa.
E vale ser honesto sobre o limite. Tráfego traz demanda, o agente organiza e qualifica a conversa, mas a venda continua sendo do seu lado do balcão. Feito 100% do lado da agência, isso é 50% do resultado. Se o agente entrega a conversa pronta e ninguém assume quando ele escala, o dinheiro para no meio do caminho.
Perguntas frequentes
Dá para pagar só a montagem e não ter custo mensal?
Não. Mesmo que a montagem fosse cobrada à parte, servidor, número e consumo do modelo continuam correndo enquanto o agente estiver no ar. E sem manutenção o agente vira uma bomba-relógio silenciosa, como no caso do filtro invertido.
Quanto tempo leva para colocar um agente em produção?
Depende de quão claro está o procedimento de atendimento. Se você já sabe a ordem das perguntas e o que precisa ir para humano, a montagem anda rápido. Se isso ainda está na cabeça de uma pessoa só, o levantamento é a parte mais demorada.
O agente precisa dizer que é uma IA?
Se a pessoa perguntar diretamente, sim, e sem rodeio. A gente escreve o agente para soar natural, com frases curtas e uma pergunta por vez, mas nunca para negar o que ele é. Quando sai do escopo, ele escala para um humano de verdade com o resumo da conversa, e a pessoa assume dali.
Quer a conta feita com os seus números?
No diagnóstico gratuito a gente dimensiona a verba e o custo por resultado realista para o seu segmento e a sua região, antes de qualquer contrato. Sai em até 24h.
Pedir meu diagnóstico →