Para saber se um agente de IA está a funcionar há cinco números e só cinco: a percentagem de pedidos que receberam resposta, o tempo até à primeira resposta no percentil 90, a taxa de passagem para humano, a taxa de entrega das mensagens e o número de conversas que acabaram num compromisso real. Se o seu painel não tem estes cinco, tem outra coisa qualquer, e essa outra coisa costuma ser favorável ao fornecedor.
A métrica que quase todos os fornecedores mostram primeiro é a taxa de contenção, ou seja, a percentagem de conversas que ficaram na IA sem passar a um humano. O problema dela é grave e pouco falado: a contenção melhora quando o cliente desiste. Um lead que recebe uma resposta vaga e sai sem insistir entra na conta como conversa contida. É o único indicador de desempenho que sobe quando o serviço piora.
Isto não é teoria. Nós operamos o nosso próprio agente comercial no WhatsApp e fomos ver o que ele fez entre 21 de junho e 15 de setembro de 2026, 86 dias de operação real, 13.248 eventos registados. Os números estão em baixo, incluindo os que não nos favorecem.
Repare na relação entre o primeiro e o segundo número. A contenção de 57,6% cairia confortavelmente dentro do intervalo de 40% a 65% que as referências públicas de 2026 apontam para um assistente bem configurado. Seria um bom diapositivo. E, ao lado dele, 32% dos pedidos que nos chegaram não receberam resposta nenhuma. Os dois números descrevem a mesma operação.
Porque é que a taxa de contenção premeia o silêncio
A distinção que separa uma operação séria de um painel bonito é esta: contenção mede se a conversa saiu do canal de IA; resolução mede se o problema da pessoa ficou resolvido. São coisas diferentes e só a segunda se correlaciona com satisfação, com menos recontactos e com poupança real.
Quando uma conversa fica sem escalonamento, há três desfechos possíveis e a contenção trata-os todos como iguais:
- O agente resolveu. Este é o desfecho que se quer, e é o único que devia contar.
- A pessoa desistiu. Recebeu meia resposta, não insistiu, foi a outro lado. Conta como contida.
- A mensagem nunca chegou. Número errado, janela fechada, template recusado. Não houve escalonamento porque não houve conversa. Também conta como contida.
Interpretação: dois dos três desfechos são falhas, e a métrica mais vendida do sector soma os três na mesma linha. É por isso que um agente pode apresentar contenção de 70% e continuar a queimar leads todas as semanas. A pergunta certa não é quantas conversas ficaram na IA, é quantos pedidos saíram de lá com uma resposta útil.
As cinco métricas que dizem a verdade
Esta é a régua que usamos, com a definição exacta de cada uma. A definição importa mais do que o valor: duas empresas com a mesma percentagem e definições diferentes não estão a falar da mesma coisa.
| Métrica | Definição que usamos | Porque é difícil de falsificar |
|---|---|---|
| Cobertura de resposta | Pedidos com pelo menos uma resposta em 24 horas, a dividir por todos os pedidos recebidos | O denominador inclui quem foi ignorado. Não há forma de subir sem responder mais |
| Tempo até à primeira resposta, P90 | Os 10% de pedidos mais lentos. Mediana ao lado, média nunca | Respostas instantâneas não escondem a cauda lenta, que é onde os leads se perdem |
| Taxa de passagem a humano | Contactos distintos sinalizados para humano, a dividir por contactos distintos que escreveram | Conta pessoas e não mensagens. Um contacto sinalizado dez vezes conta uma vez |
| Taxa de entrega | Mensagens confirmadas como entregues pela plataforma, a dividir por mensagens enviadas | Vem do lado da plataforma, não do software do agente |
| Compromissos por 100 conversas | Reuniões marcadas, chamadas aceites ou propostas pedidas, por cada 100 conversas iniciadas | O evento acontece fora do agente, num calendário ou num CRM |
A última é a mais importante das cinco e a que quase ninguém instala, porque obriga a ligar o agente ao CRM e a um calendário. Sem essa ligação, o agente é avaliado por aquilo que ele próprio regista, o que é o mesmo que deixar um aluno corrigir o seu teste.
O que 86 dias do nosso agente mostraram
Os números abaixo saem do registo de eventos da nossa linha de WhatsApp Business, entre 21 de junho e 15 de setembro de 2026. Excluímos os números internos de teste e da equipa. São 1.060 contactos a quem escrevemos, 269 que responderam, 768 mensagens recebidas e 2.045 mensagens enviadas por nós.
| Métrica | Valor medido | O que isto significa |
|---|---|---|
| Pedidos recebidos | 622 | 768 mensagens agrupadas em blocos de menos de 2 minutos |
| Cobertura de resposta em 24h | 68,0% | 199 pedidos ficaram sem resposta registada |
| Mediana da 1.ª resposta | 9 min 07 s | 46,1% dos pedidos respondidos em menos de 5 minutos |
| P90 da 1.ª resposta | 2 h 27 m | A cauda lenta que a mediana esconde por completo |
| Passagem a humano | 42,4% | 114 dos 269 contactos, em 384 sinalizações |
| Taxa de entrega | 75,6% | De 3.050 mensagens com estado confirmado |
| Falha de entrega | 18,8% | 573 mensagens, nenhuma delas chegou ao destino |
| Mensagens escritas pela IA | 99,5% | 2.035 de 2.045. Só 10 saíram da mão de uma pessoa |
Interpretação: a linha que mais nos custou ler foi a da passagem a humano. 42,4% parece razoável até se ver a distribuição: 52 dos 114 contactos foram sinalizados duas ou mais vezes e um deles 29 vezes. Um contacto sinalizado 29 vezes não é um caso complexo, é um pedido que ninguém foi buscar. O agente fez o que devia, que é levantar a mão. Foi do nosso lado que a mão ficou no ar.
Esta é a lição que levamos deste exercício e que vale para qualquer operação: a maior parte das falhas de um agente de IA não está no modelo, está no que acontece a seguir ao modelo. O escalonamento sem destino, a mensagem que não é entregue, o pedido que chega às 23h de sábado e fica à espera de segunda. Nenhuma destas coisas se corrige com um prompt melhor. É o mesmo padrão que descrevemos em agente de IA no WhatsApp para atendimento e vendas, e é a razão pela qual um piloto bem-sucedido tantas vezes não sobrevive à passagem a produção.
A métrica que ninguém olha: a mensagem que nunca chegou
De todas as linhas da tabela, a que mais dinheiro vale é a taxa de entrega. 18,8% das nossas mensagens ficaram pelo caminho e nenhuma delas registou entrega. Quase uma em cada cinco.
O detalhe perverso é que uma mensagem não entregue é invisível em todos os painéis do agente. O sistema enviou, portanto o sistema regista sucesso. Não há erro, não há alerta, não há conversa a aparecer como perdida. O lead simplesmente não existe do lado de lá, e do lado de cá ele conta como uma conversa que a IA tratou sem precisar de ninguém.
As causas habituais são prosaicas: números mal formatados sem indicativo, contactos que já não têm WhatsApp, templates recusados, janelas de 24 horas fechadas. Nenhuma é sofisticada e todas são corrigíveis. Mas só se corrige o que se mede, e a taxa de entrega raramente aparece na proposta de um fornecedor de agentes.
A Synco faz isto por si
Montamos o agente e o painel que o mede: cobertura de resposta, P90, passagem a humano, entrega e compromissos marcados, ligados ao CRM e ao calendário. A Iara e o Iago são os nossos próprios agentes, e os números deste artigo saem da operação real deles.
Como montar o painel em cinco dias
Não é preciso uma ferramenta nova. É preciso guardar cinco eventos com hora e identificador de contacto, e depois contá-los.
- Dia 1, guardar tudo. Cada mensagem recebida, cada mensagem enviada e cada mudança de estado da plataforma numa tabela, com hora exacta e número do contacto. Sem este registo não há métrica nenhuma, só estimativas.
- Dia 2, definir pedido. Agrupe mensagens seguidas do mesmo contacto com menos de dois minutos de intervalo como um só pedido. Sem isto, quem escreve três linhas seguidas conta como três clientes.
- Dia 3, cruzar com a entrega. Junte os estados de enviado, entregue, lido e falhado por identificador de mensagem. É aqui que aparecem os 18,8%.
- Dia 4, ligar ao CRM. Marque no registo do lead a reunião marcada ou a proposta pedida. É o que transforma conversas em compromissos por 100 conversas.
- Dia 5, um alarme, não um relatório. Uma regra que avisa quando a cobertura de resposta cai abaixo de um limite ou quando um contacto é sinalizado duas vezes sem ninguém lhe pegar. Um relatório semanal descobre o problema seis dias depois do lead ter ido embora.
Se ainda está a decidir se vale a pena ter um agente, o passo anterior a este está em IA para pequenas empresas: por onde começar. Se já decidiu e quer perceber a arquitectura, agentes de IA para vendas cobre a implementação.
O que muda a 1 de outubro de 2026, e o que não muda
Circula em muitos artigos, sobretudo em português do Brasil, que as mensagens de serviço do WhatsApp deixam de ser gratuitas a 1 de outubro de 2026. Fomos verificar a documentação oficial de preços da Meta a 16 de setembro de 2026 e essa alteração não está lá anunciada. O que está publicado para essa data é diferente: vários mercados saem do preço regional para tabelas próprias, com descidas em Bangladesh, Iraque, Nepal e Sri Lanka, subidas no Cazaquistão, Kuwait, Marrocos, Omã e Ucrânia, e uma tarifa de autenticação internacional mais alta em ambos os grupos. Portugal continua na região Resto da Europa Ocidental e não tem alteração anunciada.
Dizemos isto por duas razões. A primeira é prática: se orçamentou o custo do seu agente com base num artigo de terceiros, confirme na fonte antes de assinar seja o que for. A segunda é metodológica e é o ponto do artigo inteiro. Uma afirmação sem fonte e sem data comporta-se exactamente como uma taxa de contenção: parece informação, é confortável de repetir, e ninguém verifica.
Há ainda uma métrica obrigatória que nada tem a ver com desempenho. Desde 2 de agosto de 2026, o artigo 50.º do Regulamento Europeu de Inteligência Artificial exige que um sistema que fala com pessoas as informe de que é uma IA. A nossa Iara identifica-se como IA na primeira mensagem de cada conversa. Isto mede-se com um número simples, a percentagem de conversas que abrem com a identificação, e esse número só tem um valor aceitável, que é 100%.