IA & Marketing

Agente de IA: o que medir para saber se o seu está mesmo a funcionar

Para saber se um agente de IA está a funcionar há cinco números e só cinco: a percentagem de pedidos que receberam resposta, o tempo até à primeira resposta no percentil 90, a taxa de passagem para humano, a taxa de entrega das mensagens e o número de conversas que acabaram num compromisso real. Se o seu painel não tem estes cinco, tem outra coisa qualquer, e essa outra coisa costuma ser favorável ao fornecedor.

A métrica que quase todos os fornecedores mostram primeiro é a taxa de contenção, ou seja, a percentagem de conversas que ficaram na IA sem passar a um humano. O problema dela é grave e pouco falado: a contenção melhora quando o cliente desiste. Um lead que recebe uma resposta vaga e sai sem insistir entra na conta como conversa contida. É o único indicador de desempenho que sobe quando o serviço piora.

Isto não é teoria. Nós operamos o nosso próprio agente comercial no WhatsApp e fomos ver o que ele fez entre 21 de junho e 15 de setembro de 2026, 86 dias de operação real, 13.248 eventos registados. Os números estão em baixo, incluindo os que não nos favorecem.

57,6%
contenção aparente, dentro da referência de mercado
32,0%
dos pedidos sem qualquer resposta em 24 horas
18,8%
das nossas mensagens nunca chegaram a ser entregues

Repare na relação entre o primeiro e o segundo número. A contenção de 57,6% cairia confortavelmente dentro do intervalo de 40% a 65% que as referências públicas de 2026 apontam para um assistente bem configurado. Seria um bom diapositivo. E, ao lado dele, 32% dos pedidos que nos chegaram não receberam resposta nenhuma. Os dois números descrevem a mesma operação.

Porque é que a taxa de contenção premeia o silêncio

A distinção que separa uma operação séria de um painel bonito é esta: contenção mede se a conversa saiu do canal de IA; resolução mede se o problema da pessoa ficou resolvido. São coisas diferentes e só a segunda se correlaciona com satisfação, com menos recontactos e com poupança real.

Quando uma conversa fica sem escalonamento, há três desfechos possíveis e a contenção trata-os todos como iguais:

  1. O agente resolveu. Este é o desfecho que se quer, e é o único que devia contar.
  2. A pessoa desistiu. Recebeu meia resposta, não insistiu, foi a outro lado. Conta como contida.
  3. A mensagem nunca chegou. Número errado, janela fechada, template recusado. Não houve escalonamento porque não houve conversa. Também conta como contida.

Interpretação: dois dos três desfechos são falhas, e a métrica mais vendida do sector soma os três na mesma linha. É por isso que um agente pode apresentar contenção de 70% e continuar a queimar leads todas as semanas. A pergunta certa não é quantas conversas ficaram na IA, é quantos pedidos saíram de lá com uma resposta útil.

As cinco métricas que dizem a verdade

Esta é a régua que usamos, com a definição exacta de cada uma. A definição importa mais do que o valor: duas empresas com a mesma percentagem e definições diferentes não estão a falar da mesma coisa.

Métrica Definição que usamos Porque é difícil de falsificar
Cobertura de respostaPedidos com pelo menos uma resposta em 24 horas, a dividir por todos os pedidos recebidosO denominador inclui quem foi ignorado. Não há forma de subir sem responder mais
Tempo até à primeira resposta, P90Os 10% de pedidos mais lentos. Mediana ao lado, média nuncaRespostas instantâneas não escondem a cauda lenta, que é onde os leads se perdem
Taxa de passagem a humanoContactos distintos sinalizados para humano, a dividir por contactos distintos que escreveramConta pessoas e não mensagens. Um contacto sinalizado dez vezes conta uma vez
Taxa de entregaMensagens confirmadas como entregues pela plataforma, a dividir por mensagens enviadasVem do lado da plataforma, não do software do agente
Compromissos por 100 conversasReuniões marcadas, chamadas aceites ou propostas pedidas, por cada 100 conversas iniciadasO evento acontece fora do agente, num calendário ou num CRM

A última é a mais importante das cinco e a que quase ninguém instala, porque obriga a ligar o agente ao CRM e a um calendário. Sem essa ligação, o agente é avaliado por aquilo que ele próprio regista, o que é o mesmo que deixar um aluno corrigir o seu teste.

O que 86 dias do nosso agente mostraram

Os números abaixo saem do registo de eventos da nossa linha de WhatsApp Business, entre 21 de junho e 15 de setembro de 2026. Excluímos os números internos de teste e da equipa. São 1.060 contactos a quem escrevemos, 269 que responderam, 768 mensagens recebidas e 2.045 mensagens enviadas por nós.

Métrica Valor medido O que isto significa
Pedidos recebidos622768 mensagens agrupadas em blocos de menos de 2 minutos
Cobertura de resposta em 24h68,0%199 pedidos ficaram sem resposta registada
Mediana da 1.ª resposta9 min 07 s46,1% dos pedidos respondidos em menos de 5 minutos
P90 da 1.ª resposta2 h 27 mA cauda lenta que a mediana esconde por completo
Passagem a humano42,4%114 dos 269 contactos, em 384 sinalizações
Taxa de entrega75,6%De 3.050 mensagens com estado confirmado
Falha de entrega18,8%573 mensagens, nenhuma delas chegou ao destino
Mensagens escritas pela IA99,5%2.035 de 2.045. Só 10 saíram da mão de uma pessoa

Interpretação: a linha que mais nos custou ler foi a da passagem a humano. 42,4% parece razoável até se ver a distribuição: 52 dos 114 contactos foram sinalizados duas ou mais vezes e um deles 29 vezes. Um contacto sinalizado 29 vezes não é um caso complexo, é um pedido que ninguém foi buscar. O agente fez o que devia, que é levantar a mão. Foi do nosso lado que a mão ficou no ar.

Esta é a lição que levamos deste exercício e que vale para qualquer operação: a maior parte das falhas de um agente de IA não está no modelo, está no que acontece a seguir ao modelo. O escalonamento sem destino, a mensagem que não é entregue, o pedido que chega às 23h de sábado e fica à espera de segunda. Nenhuma destas coisas se corrige com um prompt melhor. É o mesmo padrão que descrevemos em agente de IA no WhatsApp para atendimento e vendas, e é a razão pela qual um piloto bem-sucedido tantas vezes não sobrevive à passagem a produção.

A métrica que ninguém olha: a mensagem que nunca chegou

De todas as linhas da tabela, a que mais dinheiro vale é a taxa de entrega. 18,8% das nossas mensagens ficaram pelo caminho e nenhuma delas registou entrega. Quase uma em cada cinco.

O detalhe perverso é que uma mensagem não entregue é invisível em todos os painéis do agente. O sistema enviou, portanto o sistema regista sucesso. Não há erro, não há alerta, não há conversa a aparecer como perdida. O lead simplesmente não existe do lado de lá, e do lado de cá ele conta como uma conversa que a IA tratou sem precisar de ninguém.

As causas habituais são prosaicas: números mal formatados sem indicativo, contactos que já não têm WhatsApp, templates recusados, janelas de 24 horas fechadas. Nenhuma é sofisticada e todas são corrigíveis. Mas só se corrige o que se mede, e a taxa de entrega raramente aparece na proposta de um fornecedor de agentes.

A Synco faz isto por si

Montamos o agente e o painel que o mede: cobertura de resposta, P90, passagem a humano, entrega e compromissos marcados, ligados ao CRM e ao calendário. A Iara e o Iago são os nossos próprios agentes, e os números deste artigo saem da operação real deles.

Ver como implementamos agentes de IA →

Como montar o painel em cinco dias

Não é preciso uma ferramenta nova. É preciso guardar cinco eventos com hora e identificador de contacto, e depois contá-los.

  1. Dia 1, guardar tudo. Cada mensagem recebida, cada mensagem enviada e cada mudança de estado da plataforma numa tabela, com hora exacta e número do contacto. Sem este registo não há métrica nenhuma, só estimativas.
  2. Dia 2, definir pedido. Agrupe mensagens seguidas do mesmo contacto com menos de dois minutos de intervalo como um só pedido. Sem isto, quem escreve três linhas seguidas conta como três clientes.
  3. Dia 3, cruzar com a entrega. Junte os estados de enviado, entregue, lido e falhado por identificador de mensagem. É aqui que aparecem os 18,8%.
  4. Dia 4, ligar ao CRM. Marque no registo do lead a reunião marcada ou a proposta pedida. É o que transforma conversas em compromissos por 100 conversas.
  5. Dia 5, um alarme, não um relatório. Uma regra que avisa quando a cobertura de resposta cai abaixo de um limite ou quando um contacto é sinalizado duas vezes sem ninguém lhe pegar. Um relatório semanal descobre o problema seis dias depois do lead ter ido embora.

Se ainda está a decidir se vale a pena ter um agente, o passo anterior a este está em IA para pequenas empresas: por onde começar. Se já decidiu e quer perceber a arquitectura, agentes de IA para vendas cobre a implementação.

O que muda a 1 de outubro de 2026, e o que não muda

Circula em muitos artigos, sobretudo em português do Brasil, que as mensagens de serviço do WhatsApp deixam de ser gratuitas a 1 de outubro de 2026. Fomos verificar a documentação oficial de preços da Meta a 16 de setembro de 2026 e essa alteração não está lá anunciada. O que está publicado para essa data é diferente: vários mercados saem do preço regional para tabelas próprias, com descidas em Bangladesh, Iraque, Nepal e Sri Lanka, subidas no Cazaquistão, Kuwait, Marrocos, Omã e Ucrânia, e uma tarifa de autenticação internacional mais alta em ambos os grupos. Portugal continua na região Resto da Europa Ocidental e não tem alteração anunciada.

Dizemos isto por duas razões. A primeira é prática: se orçamentou o custo do seu agente com base num artigo de terceiros, confirme na fonte antes de assinar seja o que for. A segunda é metodológica e é o ponto do artigo inteiro. Uma afirmação sem fonte e sem data comporta-se exactamente como uma taxa de contenção: parece informação, é confortável de repetir, e ninguém verifica.

Há ainda uma métrica obrigatória que nada tem a ver com desempenho. Desde 2 de agosto de 2026, o artigo 50.º do Regulamento Europeu de Inteligência Artificial exige que um sistema que fala com pessoas as informe de que é uma IA. A nossa Iara identifica-se como IA na primeira mensagem de cada conversa. Isto mede-se com um número simples, a percentagem de conversas que abrem com a identificação, e esse número só tem um valor aceitável, que é 100%.

Perguntas frequentes

Qual é a métrica mais importante de um agente de IA?
A percentagem de pedidos que receberam resposta. Parece óbvia e é quase sempre a que falta nos painéis, porque a maioria mede apenas as conversas que o agente tratou, nunca as que ficaram sem tratamento nenhum. Nos 86 dias que medimos na nossa própria linha de WhatsApp, 32% dos pedidos não tiveram qualquer resposta registada em 24 horas. Nenhum painel de contenção mostrava isso.
O que é a taxa de contenção e porque é que pode enganar?
A taxa de contenção é a percentagem de conversas que ficaram no canal de IA sem passar para um humano. O problema é que ela conta como sucesso tanto o pedido resolvido como o pedido abandonado. Se a pessoa recebe uma resposta vaga e desiste, o sistema regista uma conversa contida. A ausência de escalonamento passa a ser um indicador de sucesso mesmo quando ninguém foi ajudado.
Qual é uma boa taxa de resolução para um agente de IA em 2026?
As referências públicas de 2026 apontam 40% a 60% para implementações recentes e 60% a 80% para operações maduras, com o melhor do mercado acima de 80%. Para contenção, o intervalo citado para assistentes bem configurados é de 40% a 65%. Use estes números apenas como ordem de grandeza: a comparação que interessa é o seu próprio mês anterior, com a mesma definição de resolução.
Quanto tempo deve demorar um agente de IA a responder?
Um agente responde em segundos quando o caminho automático funciona, por isso a média engana. O que interessa é a cauda. Na nossa medição, a mediana da primeira resposta foi de 9 minutos e 7 segundos, mas 10% dos pedidos esperaram mais de 2 horas e 27 minutos. Meça sempre a mediana e o percentil 90, nunca a média.
Como se mede se o agente está a entregar as mensagens?
Comparando o número de mensagens enviadas com o número de mensagens confirmadas como entregues pela plataforma. São coisas diferentes e a diferença costuma ser grande. Nas 3.050 mensagens com estado registado que analisámos, 75,6% foram entregues, 52,1% foram lidas e 18,8% falharam sem nunca chegarem ao destinatário. Um agente perfeito com 18,8% de falha de entrega continua a perder quase um em cada cinco contactos.
As mensagens de serviço do WhatsApp passam a ser pagas a 1 de outubro de 2026?
A 16 de setembro de 2026 fomos verificar a documentação oficial de preços da Meta e essa alteração não está lá anunciada. O que está publicado para 1 de outubro de 2026 é a saída de vários mercados do preço regional para tabelas próprias, com descidas em Bangladesh, Iraque, Nepal e Sri Lanka e subidas no Cazaquistão, Kuwait, Marrocos, Omã e Ucrânia, mais uma tarifa de autenticação internacional mais alta. Portugal continua na região Resto da Europa Ocidental. Confirme na fonte oficial antes de orçamentar com base em artigos de terceiros.
O agente de IA tem de dizer que é uma IA?
Sim. O artigo 50.º do Regulamento Europeu de Inteligência Artificial, aplicável desde 2 de agosto de 2026, obriga a que qualquer sistema que interaja com pessoas as informe de que estão a falar com uma IA. A exceção do caso óbvio não cobre atendimento ao público. Na prática isto também é uma métrica: ou 100% das conversas abrem com a identificação, ou existe um incumprimento a contar.

Em duas linhas

Um agente de IA avalia-se pelos pedidos que ficaram sem resposta, pela cauda lenta, pelas mensagens que nunca chegaram e pelos compromissos que apareceram no calendário. Tudo o resto é o agente a avaliar-se a si próprio.

Se tiver de escolher um único número para começar esta semana, escolha a cobertura de resposta em 24 horas. Foi esse que nos mostrou 199 pedidos por atender que nenhum painel de contenção alguma vez teria revelado.

Fontes e método

Dados próprios: registo de eventos da linha WhatsApp Business da Synco Digital, 13.248 eventos entre 21 de junho e 15 de setembro de 2026, excluídos os números internos de teste e da equipa. Pedidos definidos como blocos de mensagens recebidas do mesmo contacto com menos de 120 segundos de intervalo. Taxa de entrega calculada por identificador de mensagem sobre os estados devolvidos pela plataforma. Referências de mercado de contenção e resolução recolhidas a 16 de setembro de 2026 em publicações do sector. Calendário de preços da Meta verificado a 16 de setembro de 2026 na documentação oficial de preços do WhatsApp Business Platform. Regulamento (UE) 2024/1689, artigo 50.º, aplicável desde 2 de agosto de 2026.

RC
Rangel Costa
CEO & Fundador · Synco Digital

Fundador da Synco Digital em 2021. Especializado em tráfego pago, CRM e automações de vendas para PMEs em Portugal, Brasil e Europa. Gere campanhas com CPL médio de €8,40 e ROAS de 4.8× para clientes em 5 países.

Diagnóstico gratuito

Quer ver os números do seu agente?

30 minutos. Sem compromisso. Analisamos o que o seu agente faz de facto e mostramos o que está a ficar sem resposta.

Agendar diagnóstico gratuito →