O que muda no custo do WhatsApp em 2026, e o que fazer antes de outubro
A Meta passa a cobrar mensagens de serviço em outubro e adota cobrança por token na IA nativa em agosto. O que está confirmado, o que ainda não saiu e como montar a conta da sua operação.
A Meta anunciou duas mudanças na cobrança do WhatsApp Business Platform que alteram a estrutura de custo de qualquer operação de atendimento no canal. Em agosto, a IA nativa da Meta passa a ser cobrada por token consumido. Em outubro, acaba a gratuidade das respostas dentro da janela de 24 horas, que vigora desde novembro de 2024.
A consequência prática é que o número de mensagens gasto até resolver um atendimento passa a aparecer na fatura. Quem media taxa de resolução já operava com essa lógica. Quem media tempo de primeira resposta e volume de conversas atendidas vai descobrir que estava otimizando a métrica errada.
Este artigo reúne o que a Meta confirmou oficialmente, o que ainda não foi publicado, e como montar a conta da sua operação. Onde há estimativa, está marcado como estimativa.
O cronograma confirmado
Os três pontos abaixo estão na documentação oficial da Meta, em Upcoming pricing updates for Meta Business Agent, service and utility messages.
| Data | O que muda | Quem é afetado |
|---|---|---|
| 1º de agosto de 2026 | Mensagens do Meta Business Agent passam a ser cobradas por token consumido, em cobrança única que engloba processamento e entrega | Quem usa a IA nativa da Meta |
| 1º de outubro de 2026 | Mensagens de serviço, as respostas livres dentro da janela de 24h, voltam a ser cobradas por mensagem | Toda operação de atendimento |
| 1º de outubro de 2026 | Mensagens de utilidade enviadas dentro da janela aberta também passam a ser cobradas | Quem envia avisos transacionais em resposta ao cliente |
Duas datas históricas ajudam a entender o movimento:
- 1º de novembro de 2024: mensagens de serviço passaram a ser gratuitas, e seguem assim até outubro.
- 1º de julho de 2025: utilidade dentro da janela ficou isenta, na mesma data em que a Meta abandonou a cobrança por conversa de 24 horas e migrou para cobrança por mensagem.
As mudanças de 2026 fecham esse ciclo e a plataforma inteira passa a ser tarifada por unidade enviada.
As categorias de mensagem e o que custa hoje
A Meta classifica cada mensagem em uma categoria, definida no momento em que o template é aprovado, e o preço varia por categoria e por mercado. Os valores abaixo são os oficiais para o Brasil, consultados na calculadora da Meta em 3 de junho de 2026 e publicados na nossa página sobre custos de mensagens.
| Categoria | Para que serve | Preço hoje | A partir de 1º/out/2026 |
|---|---|---|---|
| Marketing | Promoções, novidades, reengajamento | US$ 0,0625 | Sem mudança anunciada |
| Utility | Avisos transacionais: pedido, entrega, agendamento | US$ 0,0068 | Passa a ser cobrada também dentro da janela |
| Authentication | Códigos de verificação e login | US$ 0,0068 | Sem mudança anunciada |
| Service | Respostas dentro da conversa iniciada pelo cliente | Sem cobrança | Passa a ser cobrada, valor ainda não publicado |
Sobre o valor de serviço em outubro, a Meta definiu duas regras que dão uma referência razoável. A primeira é que as tarifas de serviço serão iguais às de utilidade e autenticação em cada mercado. A segunda é que serviço não terá desconto por volume, ao contrário das outras duas categorias.
Aplicando a primeira regra ao Brasil, a expectativa é que serviço fique na casa dos US$ 0,0068 por mensagem, o mesmo valor de utilidade hoje. Trate isso como expectativa fundamentada, não como preço. A Meta se comprometeu a publicar as tarifas de outubro até 1º de setembro de 2026, e é esse número que deve entrar na sua planilha. O que dá para afirmar com segurança é que não há indicação de que serviço custe mais que um template de utilidade.
Vale registrar que a Meta reajusta preços apenas no primeiro dia de cada trimestre, com aviso prévio, então a janela entre setembro e outubro é o momento certo de refazer a conta.
O que continua gratuito
A janela de 72 horas para contatos vindos de anúncios Click-to-WhatsApp segue sem taxa de entrega, e a Meta foi explícita ao dizer que ela não muda. Quando o cliente inicia a conversa clicando num anúncio do Facebook ou do Instagram e a empresa responde dentro de 24 horas, abre-se um intervalo de três dias em que marketing, utilidade, autenticação e serviço não têm custo de entrega.
Há uma exceção importante: mensagens do Meta Business Agent continuam sendo cobradas por token mesmo dentro dessa janela. Quem usa a IA nativa da Meta não tem gratuidade nenhuma a partir de agosto.
Essa janela é a mais subaproveitada da plataforma. Quem investe em anúncio que abre conversa tem três dias de troca livre com um lead que acabou de demonstrar interesse, e boa parte das operações usa esse intervalo para mandar uma saudação genérica e esperar o cliente voltar.
Cobrança por token muda a natureza da conta
A cobrança por mensagem é uma conta bem simples: conte as mensagens, multiplique pela tarifa. Cobrança por token depende do volume de texto que entra e sai do modelo a cada turno, e o que entra é maior do que a maioria imagina.
O modelo do Meta Business Agent, conforme a documentação oficial:
| Item | Valor oficial |
|---|---|
| Tarifa | US$ 2,00 por 1 milhão de tokens, global, sem variação por país |
| Consumo típico por mensagem | 20.000 a 25.000 tokens, estimativa da própria Meta |
| Custo aproximado por interação | 4 a 5 centavos de dólar, decorrente dos dois itens acima |
| Requisito operacional | Linha de crédito vinculada à conta a partir de 1º de agosto, sem ela a mensagem não é entregue |
O ponto que merece atenção é o consumo por mensagem. Vinte mil tokens é muito texto, e não é o cliente que gasta isso. O que entra no modelo a cada mensagem inclui o prompt do agente inteiro, o histórico da conversa até ali e os trechos recuperados da base de conhecimento. Um prompt de quatro mil palavras, escrito uma vez e esquecido, é reenviado a cada turno. Uma base mal recortada, que devolve páginas inteiras quando bastariam dois parágrafos, é paga a cada pergunta.
Isso vale para qualquer arquitetura de IA sobre WhatsApp, não só a nativa. Na Wevichat os agentes rodam com a sua própria chave de IA, o que significa que esse custo aparece direto na sua fatura do provedor, com os preços do seu contrato, sem margem nossa em cima. É mais transparente e também mais desconfortável, porque você vê exatamente quanto o prompt inchado está custando.
Uma comparação que circula por aí merece cuidado: a de que o Meta Business Agent sairia mais barato que um agente próprio rodando via API. A conta não fecha porque os dois modelos dependem de variáveis diferentes. No agente próprio, o custo é a tarifa por mensagem somada ao consumo da sua IA, e o consumo da sua IA depende do quanto você enxugou prompt e base. No Business Agent, o custo é só o token, mas você não controla o que a Meta injeta de contexto. Comparar os dois exige medir a sua operação, não copiar a média de alguém.
Coexistência: onde a mensagem sai define se ela custa
A Coexistência é recurso oficial da Meta e conecta o WhatsApp Business App no celular e a Cloud API ao mesmo número, sem perder histórico nem contatos. A regra financeira é direta.
| Origem da mensagem | Cobrança da Meta | Conta para limites e qualidade |
|---|---|---|
| WhatsApp Business App, no celular | Sem taxa de entrega | Não conta |
| Cloud API: plataforma, agente, campanha | Tarifada pela categoria | Conta |
O que torna isso viável operacionalmente é o espelhamento. Mensagens enviadas pelo app chegam ao webhook do número por um evento de eco, o que permite sincronizar tudo no CRM. A gestão mantém histórico e auditoria completos sem que aquela troca tenha passado pela API. É assim que funciona o modo Coexistência na Wevichat.
A partir de outubro, essa diferença deixa de ser detalhe técnico. Hoje, responder pela plataforma dentro da janela de 24h é gratuito, então tanto faz onde a mensagem sai. Depois de outubro, a mesma resposta custa se sair pela API e não custa se sair do celular. Operações com time de vendas no celular ganham uma economia que hoje não existe.
Antes de reorganizar a operação em cima disso, conheça os limites. Contas em Coexistência não recebem o selo de conta comercial oficial e usam caminho alternativo de verificação. O throughput fica fixo em cinco mensagens por segundo, o que restringe disparo em massa. Alguém precisa abrir o app periodicamente para manter a conexão, e desinstalar o aplicativo desconecta a conta. Grupos, mensagens temporárias e "ver uma vez" não são sincronizados. Reunimos isso em limitações e dúvidas frequentes.
Há ainda um problema que aparece pouco no material de venda e muito na operação real. Se o agente continua ativo enquanto o vendedor responde pelo celular, o cliente recebe duas mensagens sobre o mesmo assunto, às vezes se contradizendo. É a colisão entre robô e humano, e ela custa duas vezes: confunde o cliente e gera cobrança na API por uma mensagem que não deveria ter saído. Qualquer plataforma que suporte Coexistência precisa pausar o fluxo automático no instante em que detecta uma mensagem enviada pelo app. Sem isso, o desconto da Coexistência é teórico.
Como montar a conta da sua operação
Em vez de projetar valores que a Meta ainda não publicou, vale montar a estrutura e preencher em setembro. A conta de uma conversa tem três componentes.
| Componente | De que depende | Como reduzir |
|---|---|---|
| Entrada da conversa | Se o cliente veio de anúncio CTWA, de template ativo ou por conta própria | Priorizar entradas que abrem janela gratuita de 72h |
| Mensagens até resolver | Quantas trocas o agente gasta, multiplicado pela tarifa da categoria | Integração com sistemas e agentes especializados |
| Processamento de IA | Tamanho do prompt, histórico e contexto recuperado por turno | Enxugar prompt e recortar melhor a base de conhecimento |
O segundo componente é onde está a maior parte do dinheiro, e é o mais ignorado. Um agente sem acesso a estoque, rastreio e histórico de compras responde no genérico, e resposta genérica gera pergunta de confirmação. O cliente pergunta se o pedido chegou, o agente responde que costuma levar de cinco a dez dias úteis, o cliente pergunta pelo dele especificamente, o agente pede o número do pedido, o cliente manda, o agente pede o CPF. Cinco trocas para uma informação que estava em uma consulta de API.
Com integração, a mesma conversa tem duas mensagens. É por isso que as ações do agente, consultar sistema, agendar, atualizar cadastro, disparar webhook no meio do chat, deixam de ser conveniência e viram controle de custo direto.
A segunda alavanca é especialização. Um agente generalista gasta as primeiras trocas descobrindo do que a conversa se trata. Um agente de recuperação de carrinho já sabe qual produto ficou para trás e abre falando dele. Numa arquitetura multi-agente, um orquestrador identifica a intenção e roteia para o especialista certo, o que economiza justamente as mensagens de triagem, as mais caras em relação ao que entregam.
Onde esse raciocínio quebra
Otimizar conversa pelo custo por mensagem tem um limite claro, e passar dele sai caro de outro jeito.
Um agente pressionado a fechar em duas mensagens encerra conversa que deveria continuar, chuta resposta quando deveria perguntar e empurra para o humano casos que resolveria com mais uma troca. O custo aparece no ticket perdido, não na fatura da Meta. Uma negociação consultiva de valor alto vai levar quinze mensagens porque o negócio é assim, e centavos de tarifa nunca foram o gargalo ali.
A conta que importa é custo por conversa resolvida. Custo por mensagem é fácil de melhorar destruindo o primeiro.
Também vale reconhecer o que ainda dá trabalho no nosso lado: manter a base de conhecimento atualizada continua sendo trabalho humano. Nenhum agente percebe sozinho que o prazo de entrega mudou de cinco para dez dias úteis. Ele vai continuar respondendo cinco, com convicção, até alguém corrigir a base, e a conversa se estende justamente porque o cliente volta contestando.
O que fazer antes de outubro
Comece medindo. Pegue as últimas cem conversas do seu agente e conte quantas mensagens ele gastou até o cliente ter o que queria, separando as que terminaram sem resolução. Essa distribuição diz mais sobre o seu custo futuro que qualquer simulação de preço.
Depois, olhe as três perguntas mais frequentes e verifique se o agente consegue respondê-las consultando um sistema ou se depende de o cliente informar tudo. Cada dado que ele busca sozinho corta uma troca.
Se você tem vendedor atendendo pelo celular, confira se o fluxo automático pausa quando alguém responde pelo app, e avalie mover o fechamento de vendas consultivas para a Coexistência. A partir de outubro isso deixa de ser preferência de operação e vira diferença de custo.
Por fim, marque 1º de setembro na agenda. É o prazo em que a Meta publica as tarifas de outubro, incluindo a de serviço. Toda projeção feita antes disso, inclusive a expectativa que registramos aqui, é estimativa que precisa ser confirmada.
Receba os próximos artigos por email
Sem spam. Só conteúdo novo sobre atendimento e IA, quando publicarmos.