Uma rubrica de avaliação de atendimento é o conjunto de critérios que uma equipe de atendimento usa para avaliar uma conversa com o cliente, com a descrição de como é cada nível de avaliação e de quanto cada critério vale. Ela transforma “bom atendimento” em itens que dois avaliadores conseguem avaliar da mesma forma, e é a lógica por trás de toda nota de QA.
Em resumo
- Uma rubrica de QA tem cinco partes: critérios, uma escala de avaliação, descrições dos níveis, pesos e uma lista curta de itens críticos.
- As descrições dos níveis são o que faz dela uma rubrica, e não um checklist, porque dizem ao avaliador o que “atendido em parte” significa de fato.
- A nota de QA é a pontuação obtida dividida pela pontuação possível, e a forma de tratar o “não se aplica” pode mudá-la em dez pontos.
- A maioria das equipes de atendimento se sai bem com 5 a 8 critérios que podem ser verificados só pela transcrição.
O que uma rubrica de avaliação contém
Uma rubrica de avaliação contém cinco partes: os critérios avaliados, a escala de avaliação de cada um, uma descrição escrita de cada nível dessa escala, um peso que define quanto cada critério vale e alguns itens críticos que reprovam a conversa de imediato. Tire qualquer uma delas e os avaliadores passam a preencher a lacuna com julgamento pessoal.
A palavra vem da educação. O centro de ensino da Carnegie Mellon define uma rubrica como “uma ferramenta de avaliação que representa de forma explícita as expectativas de desempenho para uma tarefa” (tradução livre) e observa que as rubricas ajudam a garantir consistência entre os corretores em disciplinas que têm vários deles. Uma equipe de atendimento com dez avaliadores tem exatamente esse problema.
| Parte | O que responde | Exemplo |
|---|---|---|
| Critério | O que estamos avaliando? | “A resposta estava correta e completa” |
| Escala de avaliação | Quantos resultados são possíveis? | Atendido, atendido em parte, não atendido, não se aplica |
| Descrições dos níveis | Como é cada resultado? | “Atendido em parte: correto, mas falta um detalhe necessário” |
| Peso | Quanto vale? | 30 de 100 pontos |
| Item crítico | O que reprova a conversa inteira? | Dados da conta compartilhados antes da verificação de identidade |
Os itens críticos costumam ser chamados de erros críticos: uma única falha zera a nota, não importa o que tenha acontecido no resto. Em software, a rubrica é o conjunto de critérios e descrições que o software de formulário de monitoria aplica a cada conversa.
Rubrica de QA, formulário de monitoria e checklist
Uma rubrica de QA, um formulário de monitoria e um checklist de QA descrevem a mesma atividade com níveis de detalhe diferentes. A rubrica é a lógica de avaliação, o formulário é o que o avaliador preenche, e o checklist é uma lista de itens de sim ou não, sem descrição dos níveis e em geral sem pesos. Muitas equipes usam os termos como sinônimos.
| Checklist de QA | Formulário de monitoria | Rubrica de QA | |
|---|---|---|---|
| Pergunta principal | Aconteceu? | Que nota recebeu? | O que cada nota significa? |
| Avaliação | Sim ou não | Sim ou não, ou uma escala | Escala com uma descrição por nível |
| Pesos | Raramente | Normalmente | Normalmente |
| Melhor para | Etapas de processo e compliance | Avaliação do dia a dia | Concordância entre avaliadores, contestações, automação |
Na prática, o seu formulário de monitoria é a rubrica mais tudo o que vem em volta dela: o link da conversa, o avaliador, os comentários e a nota final. Se o seu formulário tem critérios e pesos, mas nenhuma descrição escrita de cada nível, você tem um formulário que ainda precisa da sua rubrica.
Exemplo de rubrica de avaliação de atendimento para chat e e-mail
Veja uma rubrica de avaliação de atendimento completa para atendimento escrito em chat e e-mail: seis critérios ponderados que somam 100 pontos, uma escala de três níveis com a descrição de cada nível e dois itens críticos. É uma ilustração para adaptar, não um padrão. Ajuste os critérios aos seus produtos, políticas e motivos de contato.
| Critério | Peso | Atendido (pontuação total) | Atendido em parte (metade) | Não atendido (0) |
|---|---|---|---|---|
| Entendeu o problema real | 15 | Reformula ou age sobre o problema de fato, faz uma pergunta de esclarecimento quando o pedido é ambíguo | Responde à pergunta literal, mas não percebe a necessidade por trás dela | Responde a uma pergunta diferente da que foi feita |
| Resposta correta e completa | 30 | A informação é precisa e cobre tudo o que o cliente precisa para agir | Precisa, mas falta um detalhe necessário | Informação errada, desatualizada ou enganosa |
| Seguiu o processo exigido | 20 | Todas as etapas exigidas para esse motivo de contato foram cumpridas (política de reembolso, caminho de escalonamento, tags) | Uma etapa menor foi pulada, sem efeito para o cliente | Uma etapa exigida foi pulada e o cliente foi afetado |
| Próximo passo e prazo claros | 15 | Diz o que acontece a seguir, quem faz e até quando | Próximo passo informado, sem prazo | O cliente fica adivinhando o que vai acontecer |
| Tom adequado à situação | 10 | Reconhece a frustração quando existe, linguagem simples, sem culpar ninguém | Educado, mas genérico ou padronizado onde não deveria ser | Desdenhoso, acusatório ou confuso |
| Notas suficientes para a próxima pessoa | 10 | A nota interna ou os campos do ticket permitem que um colega continue sem reler a conversa | Há notas, mas falta um fato importante | Nenhuma nota em uma conversa que exige repasse |
Itens críticos (nota zerada): dados da conta ou dados pessoais compartilhados antes da verificação de identidade; um reembolso ou crédito prometido fora da política.
Duas coisas fazem disso uma rubrica, e não uma lista. Cada nível tem uma descrição que o avaliador pode apontar na transcrição, e “notas” pode ser marcado como não se aplica quando não há repasse. Para versões prontas por canal, veja os nossos modelos de formulário de monitoria (em inglês).
Como a nota de QA é calculada a partir da rubrica
A nota de QA é a pontuação que uma conversa obteve dividida pela pontuação que poderia ter obtido, expressa em percentual. Na maioria das configurações, os critérios marcados como não se aplica saem dos dois números, e um item crítico zera a nota. A média dessas notas entre conversas dá a nota de qualidade de um atendente ou de uma equipe.
Veja um e-mail avaliado com a rubrica acima:
| Critério | Peso | Avaliação | Pontos |
|---|---|---|---|
| Entendeu o problema real | 15 | Atendido | 15 |
| Resposta correta e completa | 30 | Atendido em parte | 15 |
| Seguiu o processo exigido | 20 | Atendido | 20 |
| Próximo passo e prazo claros | 15 | Não atendido | 0 |
| Tom adequado à situação | 10 | Atendido | 10 |
| Notas para a próxima pessoa | 10 | Não se aplica | removido |
A conversa obteve 60 pontos de 90 possíveis, então a nota é 67%. Repare no efeito da regra do “não se aplica”. Se a equipe contasse o item como falha, a nota seria 60 de 100, ou seja, 60%. Se contasse como acerto, 70 de 100, ou 70%. A mesma conversa, uma diferença de dez pontos, apenas por causa de uma regra que ninguém escreveu.
Por isso a regra do N/A tem que estar na própria rubrica. Os pesos importam tanto quanto: um deslize no tom custa 5 pontos aqui, enquanto uma resposta errada custa até 30. O nosso guia sobre peso dos itens de monitoria mostra como definir esses números com base em evidências, e o artigo sobre a nota de qualidade interna explica como as notas de cada conversa se consolidam em um número da equipe.
Analítica ou holística: como escolher o formato da rubrica
Existem dois formatos de rubrica. A rubrica analítica avalia cada critério separadamente e depois os combina, que é o que quase toda rubrica de QA de atendimento faz. A rubrica holística dá uma avaliação geral com base em uma única descrição de qualidade. A analítica leva mais tempo para montar, mas diz ao atendente exatamente que parte da conversa corrigir.
O escritório de avaliação da University of Oklahoma resume a escolha: na rubrica analítica, cada “critério pode ser ponderado para refletir a importância relativa de cada dimensão”, enquanto na rubrica holística “os critérios não podem ser ponderados” (tradução livre). A mesma página observa que as rubricas analíticas levam mais tempo para criar e aplicar.
Para equipes de atendimento, a escolha costuma ser simples:
- Use a analítica para monitoria de atendentes, coaching e tudo o que está ligado a uma meta ou a um bônus. Os atendentes precisam saber qual critério custou pontos.
- Use a holística para checagens rápidas, como um gestor classificando um lote de conversas como “boa, precisa melhorar, ruim” para identificar um problema antes de montar uma rubrica completa.
Quais critérios de monitoria de qualidade entram na rubrica
Um critério entra na rubrica de QA quando passa em quatro testes: o avaliador consegue vê-lo na conversa, ele verifica uma única coisa, o atendente tem controle sobre ele e ele se aplica ao tipo de contato avaliado. Critérios que não passam nesses testes geram as notas que os atendentes mais contestam, porque dois avaliadores justos podem chegar a veredictos diferentes.
- Observável. “Demonstrou empatia” é uma sensação. “Reconheceu a frustração do cliente antes de responder” é algo que dá para citar.
- Uma verificação por critério. “Cumprimentou o cliente e verificou a identidade” são dois critérios. Separe tudo o que estiver unido por “e”.
- Sob controle do atendente. Uma ferramenta lenta ou uma política que o atendente não pode mudar não deveria custar pontos a ele. Registre isso como um problema de processo.
- Adequado ao motivo de contato. Criar rapport faz sentido em uma reclamação e muito pouco em uma redefinição de senha. Em uma discussão no Reddit sobre notas de QA, um atendente de uma comercializadora de energia reclamou de ser avaliado por “levar o cliente em uma jornada” quando o cliente só queria fazer um pagamento.
Quanto à quantidade, a maioria dos profissionais chega a uma lista curta. Um participante de uma discussão no Reddit sobre refazer a monitoria em uma planilha aconselhou reduzir a rubrica a “5 a 7 critérios e fazer com que a maioria possa ser verificada pelo texto do ticket”. Se você pretende automatizar a avaliação, a exigência é ainda maior; o nosso guia sobre como escrever critérios que uma IA consegue avaliar (em inglês) reescreve critérios vagos comuns em critérios verificáveis.
Como montar uma rubrica de QA em seis passos
Montar uma rubrica de QA leva seis passos: escolher os resultados que ela deve proteger, listar os comportamentos que levam a eles, escrever cada um como um critério observável, descrever cada nível de avaliação, definir pesos e itens críticos e testá-la em conversas reais com vários avaliadores antes que os atendentes vejam uma única nota.
- Comece pelos resultados. Escreva as três ou quatro coisas que uma boa conversa precisa alcançar para o seu negócio: uma resposta correta, um problema resolvido, um processo em conformidade, um cliente que sabe o que acontece a seguir.
- Liste os comportamentos por trás deles. Leia de 20 a 30 conversas recentes, boas e ruins, e anote quais atitudes dos atendentes fizeram a diferença.
- Escreva os critérios. Transforme cada comportamento em uma afirmação única e observável, usando os quatro testes acima.
- Descreva cada nível. Para cada critério, escreva como é o atendido, o atendido em parte e o não atendido, com um exemplo curto de uma transcrição real.
- Defina pesos e itens críticos. Dê mais pontos ao que mais prejudica os clientes. Limite os itens críticos às duas ou três falhas realmente inegociáveis.
- Teste antes de implantar. Peça a três ou quatro avaliadores que avaliem as mesmas dez conversas de forma independente e compare. Onde eles discordam, a descrição não está clara, e o problema não é o avaliador.
O passo 6 é o que as equipes pulam. Em uma discussão no Reddit sobre ferramentas de formulário de monitoria, um participante contou que dois avaliadores deram 60 e 85 ao mesmo ticket porque “demonstrou empatia” significava uma coisa diferente para cada um, e disse que os atendentes “pararam de confiar no número”. A calibração de monitoria feita com regularidade mantém essa diferença sob controle depois da implantação. Um participante que respondeu à mesma pergunta, publicada em um segundo subreddit, levantou outro ponto prático: tickets de cobrança, escalonamentos de bugs e pedidos de reembolso podem precisar de rubricas separadas, porque “não compartilham critérios”.
Aplicar uma única rubrica a todas as conversas
Uma rubrica só compensa quando é aplicada da mesma forma a todas as conversas, e é aí que a avaliação manual chega ao limite. Um avaliador lendo uma amostra pequena não consegue avaliar de forma consistente em volume, e cada avaliador se desvia um pouco com o tempo. A avaliação automatizada aplica um único padrão escrito a todas elas, sem ninguém cansado ou com pressa.
A Kaizo usa os seus critérios atuais em vez de impor um modelo e avalia 100% das suas conversas de atendimento com base neles, seja uma pessoa ou um agente de IA quem respondeu, com a evidência ligada a cada nota. Quando você muda a descrição de um critério, a mudança vale para todas as avaliações futuras, e ninguém precisa reorientar uma equipe de avaliadores. Na UiPath, a Kaizo automatizou 100% do QA com 200% de ROI. Na EverHelp, o tempo de preparação do coaching caiu 75%.
Veja nas suas próprias conversas. A Kaizo avalia 100% das suas conversas de atendimento com a sua própria rubrica e transforma os resultados em coaching. Agende uma demo ou veja como funciona o software de formulário de monitoria.
Quando uma rubrica formal não é para você
Uma rubrica completa, ponderada e com descrição dos níveis não vale o esforço para toda equipe. Se uma ou duas pessoas cuidam de algumas dezenas de tickets por semana, um gestor que lê as conversas e dá feedback direto cobre o mesmo terreno com menos trabalho. Um checklist curto de sim ou não basta até que comecem a surgir divergências sobre qualidade.
Uma rubrica também não resolve um problema de processo. Se os atendentes falham no mesmo critério de forma geral, a causa costuma ser uma política, uma ferramenta ou o treinamento, e avaliar com mais rigor só faz as notas parecerem piores. Monte a rubrica quando tiver vários avaliadores, atendentes perguntando por que perderam pontos ou um plano para avaliar conversas de forma automática.
Perguntas frequentes
O que significa rubrica de QA?
Rubrica de QA é o guia de avaliação que uma equipe de monitoria de qualidade usa para avaliar conversas com clientes. Ela lista os critérios, a escala de avaliação, como é cada nível e quanto vale cada critério. “Rubrica de monitoria de qualidade” e “formulário de monitoria” são nomes comuns para a mesma coisa.
O que é a nota de QA?
A nota de QA é o resultado da aplicação da rubrica a uma conversa: a pontuação obtida dividida pela pontuação possível, em percentual. Os critérios marcados como não se aplica costumam sair dos dois números, e um item crítico zera a nota. As notas de qualidade da equipe e do atendente são médias dessas notas por conversa.
Quantos critérios uma rubrica de QA deve ter?
A maioria das equipes de atendimento se sai bem com 5 a 8 critérios, cada um verificável pela transcrição. Menos do que isso raramente cobre precisão, processo e comunicação ao mesmo tempo, e listas muito mais longas são lentas de revisar e difíceis de avaliar com consistência. Equipes com tipos de contato muito diferentes costumam manter uma rubrica curta por tipo, em vez de uma longa.
A rubrica de QA deve usar uma escala de sim ou não ou de 1 a 5?
Use sim ou não para etapas que aconteceram ou não, como a verificação de identidade ou um aviso obrigatório. Use uma escala de três níveis (atendido, atendido em parte, não atendido) para comportamentos com graus reais, como a completude da resposta. Escalas de cinco pontos só valem a pena quando cada ponto tem a sua própria descrição escrita.
Com que frequência atualizar uma rubrica de QA?
Revise a rubrica quando produtos, políticas ou motivos de contato mudarem, e pelo menos algumas vezes por ano. Mude um critério de cada vez e anote a data, porque cada mudança altera as notas e dificulta a comparação das tendências antes e depois dela.
Uma rubrica de QA pode ser usada para agentes de IA?
Sim. A mesma rubrica pode avaliar conversas atendidas por um agente de IA e por pessoas, o que mantém a qualidade comparável entre os dois. Os critérios precisam ser observáveis na transcrição, o que já é uma boa prática na avaliação humana.