Une grille de critères qualité (en anglais « QA rubric ») est l’ensemble des critères qu’une équipe support utilise pour évaluer une conversation client, avec la description de chaque niveau de notation et le poids de chaque critère. Elle transforme le « bon service » en lignes que deux évaluateurs peuvent noter de la même façon, et c’est la logique derrière chaque note qualité.
En bref
- Une grille de critères qualité comporte cinq éléments : des critères, une échelle de notation, la description des niveaux, des pondérations et une courte liste d’éléments critiques.
- C’est la description des niveaux qui en fait une grille plutôt qu’une simple checklist, car elle dit aux évaluateurs ce que « partiellement atteint » veut vraiment dire.
- La note qualité correspond aux points obtenus divisés par les points possibles, et la façon de traiter le « non applicable » peut la déplacer de dix points.
- La plupart des équipes support s’en sortent bien avec 5 à 8 critères vérifiables à partir de la seule transcription.
Ce que contient une grille de critères qualité
Une grille de critères qualité contient cinq éléments : les critères évalués, l’échelle de notation de chacun, une description écrite de chaque niveau de cette échelle, une pondération qui fixe le poids de chaque critère, et quelques éléments critiques qui font échouer la conversation d’office. Retirez-en un seul, et les évaluateurs comblent le vide avec leur jugement personnel.
Le terme anglais « rubric » vient de l’enseignement. Le centre pédagogique de l’université Carnegie Mellon définit la rubric comme « un outil de notation qui représente explicitement les attentes de performance pour un travail » (en anglais) et précise qu’elle aide à garantir la cohérence entre correcteurs dans les cours qui en comptent plusieurs. Une équipe support avec dix évaluateurs a exactement ce problème.
| Élément | À quelle question il répond | Exemple |
|---|---|---|
| Critère | Qu’évalue-t-on ? | « La réponse était correcte et complète » |
| Échelle de notation | Combien de résultats possibles ? | Atteint, partiellement atteint, non atteint, non applicable |
| Description des niveaux | À quoi ressemble chaque résultat ? | « Partiellement atteint : correct, mais il manque un détail nécessaire » |
| Pondération | Combien compte-t-il ? | 30 points sur 100 |
| Élément critique | Qu’est-ce qui fait échouer toute la conversation ? | Données du compte communiquées avant la vérification d’identité |
Les éléments critiques sont généralement appelés critères éliminatoires (en anglais « auto-fail ») : un seul manquement ramène la note à zéro, quoi qu’il se soit passé par ailleurs. Dans un logiciel, la grille est l’ensemble des critères et des descriptions qu’un logiciel de grille d’évaluation applique à chaque conversation.
Grille de critères, grille d’évaluation et checklist
Une grille de critères qualité, une grille d’évaluation et une checklist qualité décrivent la même activité à des niveaux de détail différents. La grille de critères est la logique de notation, la grille d’évaluation est le formulaire que remplit l’évaluateur, et une checklist est une liste d’éléments oui ou non, sans description des niveaux et en général sans pondération. Beaucoup d’équipes emploient ces mots indifféremment.
| Checklist qualité | Grille d’évaluation | Grille de critères qualité | |
|---|---|---|---|
| Question principale | Est-ce que c’est fait ? | Quelle note a-t-elle obtenue ? | Que signifie chaque note ? |
| Notation | Oui ou non | Oui ou non, ou une échelle | Échelle avec une description par niveau |
| Pondérations | Rarement | En général | En général |
| Idéale pour | Étapes de processus et de conformité | L’évaluation au quotidien | L’accord entre évaluateurs, les contestations, l’automatisation |
En pratique, votre grille d’évaluation est la grille de critères plus le formulaire autour : le lien vers la conversation, l’évaluateur, les commentaires et la note finale. Si votre grille d’évaluation a des critères et des pondérations mais aucune description écrite de chaque niveau, il lui manque encore sa grille de critères.
Un exemple de grille de critères qualité pour le chat et l’e-mail
Voici une grille de critères qualité complète pour le support écrit par chat et par e-mail : six critères pondérés pour 100 points, une échelle à trois niveaux avec la description de chacun, et deux éléments critiques. C’est une illustration à adapter, pas une norme. Modifiez les critères selon vos produits, vos règles et vos motifs de contact.
| Critère | Poids | Atteint (tous les points) | Partiellement atteint (moitié) | Non atteint (0) |
|---|---|---|---|---|
| A compris le vrai problème | 15 | Reformule le problème réel ou agit dessus, pose une question de clarification quand la demande est ambiguë | Répond à la question littérale mais passe à côté du besoin de fond | Répond à une autre question que celle posée |
| Réponse correcte et complète | 30 | L’information est exacte et couvre tout ce dont le client a besoin pour agir | Exacte, mais il manque un détail nécessaire | Information fausse, obsolète ou trompeuse |
| A suivi le processus requis | 20 | Chaque étape requise pour ce motif de contact est faite (politique de remboursement, circuit d’escalade, tags) | Une étape mineure est sautée, sans effet pour le client | Une étape requise est sautée et le client en subit l’effet |
| Prochaine étape et délai clairs | 15 | Dit ce qui va se passer, qui s’en charge et pour quand | Prochaine étape donnée, délai manquant | Le client doit deviner la suite |
| Ton adapté à la situation | 10 | Reconnaît la frustration quand elle est là, langage simple, sans rejeter la faute | Poli mais générique, ou trop proche d’un modèle là où il ne le faudrait pas | Méprisant, culpabilisant ou confus |
| Notes suffisantes pour la personne suivante | 10 | La note interne ou les champs du ticket permettent à un collègue de reprendre sans relire tout le fil | Des notes existent mais il manque un fait clé | Aucune note sur une conversation qui doit être transmise |
Éléments critiques (note ramenée à zéro) : données du compte ou données personnelles communiquées avant la vérification d’identité ; remboursement ou avoir promis hors politique.
Deux choses en font une grille plutôt qu’une liste. Chaque niveau a une description que l’évaluateur peut pointer dans la transcription, et les « notes » peuvent être marquées non applicables quand aucune transmission n’est nécessaire. Pour des versions prêtes à l’emploi par canal, consultez nos modèles de grille d’évaluation (en anglais).
Comment calculer la note qualité à partir de la grille
Une note qualité correspond aux points obtenus par une conversation divisés par les points qu’elle aurait pu obtenir, exprimés en pourcentage. Dans la plupart des configurations, les critères marqués non applicables sortent des deux nombres, et un élément critique ramène la note à zéro. La moyenne de ces notes sur l’ensemble des conversations donne la note qualité d’un conseiller ou d’une équipe.
Prenons un e-mail évalué avec la grille ci-dessus :
| Critère | Poids | Évaluation | Points |
|---|---|---|---|
| A compris le vrai problème | 15 | Atteint | 15 |
| Réponse correcte et complète | 30 | Partiellement atteint | 15 |
| A suivi le processus requis | 20 | Atteint | 20 |
| Prochaine étape et délai clairs | 15 | Non atteint | 0 |
| Ton adapté à la situation | 10 | Atteint | 10 |
| Notes pour la personne suivante | 10 | Non applicable | retiré |
La conversation a obtenu 60 points sur 90 possibles, la note est donc de 67 %. Regardez l’effet de la règle du « non applicable ». Si l’équipe le comptait comme un échec, la note serait de 60 sur 100, soit 60 %. S’il comptait comme réussi, 70 sur 100, soit 70 %. Même conversation, dix points d’écart, uniquement à cause d’une règle que personne n’a écrite.
C’est pourquoi la règle du non applicable doit figurer dans la grille elle-même. Les pondérations comptent tout autant : un écart de ton coûte ici 5 points, alors qu’une mauvaise réponse en coûte jusqu’à 30. Notre guide sur la pondération d’une grille d’évaluation montre comment fixer ces chiffres à partir de données, et l’article sur le score qualité interne explique comment les notes par conversation se consolident en un seul chiffre d’équipe.
Analytique ou globale : choisir le format de la grille
Il existe deux formats de grille. Une grille analytique note chaque critère séparément puis les combine, ce que fait presque toute grille de contrôle qualité en support. Une grille globale (ou holistique) attribue une seule note d’ensemble au regard d’une description unique de la qualité. La grille analytique demande plus de temps à construire, mais elle indique au conseiller exactement quelle partie de la conversation corriger.
Le service d’évaluation de l’université de l’Oklahoma résume le compromis : dans une grille analytique, « chaque critère peut être pondéré pour refléter l’importance relative de chaque dimension » (en anglais), alors qu’avec une grille holistique « les critères ne peuvent pas être pondérés ». La même page note que les grilles analytiques prennent plus de temps à concevoir et à appliquer.
Pour les équipes support, le choix est en général simple :
- Grille analytique pour la QA des conseillers, le coaching et tout ce qui est lié à un objectif ou à une prime. Les conseillers doivent savoir quel critère leur a coûté des points.
- Grille globale pour des bilans rapides, par exemple quand un manager classe un lot de conversations en « bon, à améliorer, insuffisant » pour repérer un problème avant de construire une grille complète.
Quels critères qualité mettre dans la grille
Un critère a sa place dans une grille de critères qualité s’il passe quatre tests : l’évaluateur peut le constater dans la conversation, il vérifie une seule chose, le conseiller le maîtrise, et il s’applique au type de contact évalué. Les critères qui échouent à ces tests produisent les notes que les conseillers contestent le plus, car deux évaluateurs de bonne foi peuvent aboutir à des verdicts différents.
- Observable. « A fait preuve d’empathie » est un ressenti. « A reconnu la frustration du client avant de répondre » est une chose que l’on peut citer.
- Une vérification par critère. « A salué le client et vérifié son identité » fait deux critères. Séparez tout ce qui est relié par « et ».
- Sous le contrôle du conseiller. Un outil lent ou une règle que le conseiller ne peut pas changer ne doit pas lui coûter de points. Suivez-le plutôt comme un problème de processus.
- Adapté au motif de contact. Créer une relation a du sens sur une réclamation, et très peu sur une réinitialisation de mot de passe. Dans un fil Reddit sur les notes qualité, un conseiller d’un fournisseur d’énergie se plaignait d’être évalué sur le fait d’« emmener le client dans un parcours » alors que le client voulait seulement effectuer un paiement.
Côté nombre, la plupart des praticiens s’en tiennent à une liste courte. Un intervenant dans un fil Reddit sur la refonte de la QA dans un tableur conseillait de réduire la grille à « 5 à 7 critères », la plupart « vérifiables à partir du texte du ticket ». Si vous prévoyez d’automatiser l’évaluation, la barre est encore plus haute ; notre guide pour rédiger des critères qu’une IA peut évaluer (en anglais) réécrit des critères flous courants en critères vérifiables.
Construire une grille de critères qualité en six étapes
Construire une grille de critères qualité se fait en six étapes : choisir les résultats qu’elle doit protéger, lister les comportements qui y mènent, écrire chacun comme un critère observable, décrire chaque niveau de notation, fixer les pondérations et les éléments critiques, puis la tester sur de vraies conversations avec plusieurs évaluateurs avant qu’un conseiller ne voie la moindre note.
- Partir des résultats. Notez les trois ou quatre choses qu’une bonne conversation doit obtenir pour votre entreprise : une réponse correcte, une demande résolue, un processus conforme, un client qui sait ce qui va se passer.
- Lister les comportements derrière. Lisez 20 à 30 conversations récentes, bonnes et mauvaises, et notez ce que les conseillers ont fait qui a fait la différence.
- Rédiger les critères. Transformez chaque comportement en un énoncé unique et observable, en appliquant les quatre tests ci-dessus.
- Décrire chaque niveau. Pour chaque critère, écrivez à quoi ressemblent atteint, partiellement atteint et non atteint, avec un court exemple tiré d’une vraie transcription.
- Fixer pondérations et éléments critiques. Donnez le plus de points à ce qui nuit le plus aux clients. Limitez les éléments critiques aux deux ou trois manquements vraiment non négociables.
- Tester avant le déploiement. Faites évaluer les mêmes dix conversations par trois ou quatre évaluateurs, chacun de son côté, puis comparez. Là où ils ne sont pas d’accord, c’est la description qui manque de clarté, pas l’évaluateur.
L’étape 6 est celle que les équipes sautent. Dans un fil Reddit sur les outils de grille d’évaluation, un intervenant racontait que deux évaluateurs avaient noté le même ticket 60 et 85 parce que « a fait preuve d’empathie » ne voulait pas dire la même chose pour chacun, et que les conseillers avaient « cessé de faire confiance au chiffre ». Un calibrage qualité régulier évite que cet écart ne se rouvre après le lancement. Un intervenant sur la même question, publiée dans un second subreddit, faisait une autre remarque pratique : les tickets de facturation, les escalades de bugs et les demandes de remboursement peuvent nécessiter des grilles distinctes, car ils « ne partagent pas les mêmes critères ».
Appliquer une seule grille à chaque conversation
Une grille n’est rentable que si elle est appliquée de la même façon à chaque conversation, et c’est là que l’évaluation manuelle atteint ses limites. Un évaluateur qui lit un petit échantillon ne peut pas noter de façon cohérente à grande échelle, et chaque évaluateur dérive un peu avec le temps. L’évaluation automatisée applique une seule norme écrite à toutes les conversations, sans fatigue ni précipitation.
Kaizo reprend vos critères existants au lieu de vous imposer un modèle, et évalue 100 % de vos conversations support selon ces critères, qu’un humain ou un agent IA ait répondu, avec les éléments de preuve liés à chaque note. Quand vous modifiez la description d’un critère, le changement s’applique à toutes les évaluations futures, sans qu’il faille redonner des consignes à toute une équipe d’évaluateurs. Chez UiPath, Kaizo a automatisé 100 % de la QA avec un ROI de 200 %. Chez EverHelp (en anglais), le temps de préparation du coaching a baissé de 75 %.
Voyez-le sur vos propres conversations. Kaizo évalue 100 % de vos conversations support selon votre propre grille et transforme les résultats en coaching. Réservez une démo ou découvrez comment fonctionne le logiciel de grille d’évaluation.
Quand une grille formelle n’est pas pour vous
Une grille complète, pondérée et avec description des niveaux, ne vaut pas la peine d’être construite pour toutes les équipes. Si une ou deux personnes traitent quelques dizaines de tickets par semaine, un manager qui lit les conversations et fait un retour direct couvre le même terrain avec moins de lourdeur. Une courte checklist oui ou non suffit jusqu’à ce que des désaccords sur la qualité apparaissent.
Une grille ne réglera pas non plus un problème de processus. Si les conseillers échouent tous sur le même critère, la cause est en général une règle, un outil ou la formation, et noter plus sévèrement ne fait que dégrader les notes. Construisez la grille quand vous avez plusieurs évaluateurs, des conseillers qui demandent pourquoi ils ont perdu des points, ou un projet d’évaluation automatique des conversations.
Questions fréquentes
Que veut dire QA rubric ?
QA rubric désigne le guide de notation qu’une équipe de contrôle qualité utilise pour évaluer les conversations clients, en français une grille de critères qualité. Il liste les critères, l’échelle de notation, ce à quoi ressemble chaque niveau et le poids de chaque critère. « Quality assurance rubric » et « quality scorecard » sont des noms courants pour la même chose.
Qu’est-ce qu’une note qualité ?
Une note qualité est le résultat de l’application de la grille à une conversation : points obtenus divisés par points possibles, en pourcentage. Les critères marqués non applicables sont en général retirés des deux nombres, et un élément critique ramène la note à zéro. Les notes qualité des équipes et des conseillers sont des moyennes de ces notes par conversation.
Combien de critères doit compter une grille de critères qualité ?
La plupart des équipes support s’en sortent bien avec 5 à 8 critères, chacun vérifiable à partir de la transcription. En dessous, on couvre rarement à la fois l’exactitude, le processus et la communication, et des listes beaucoup plus longues sont lentes à évaluer et difficiles à noter de façon cohérente. Les équipes aux types de contact très différents gardent souvent une courte grille par type plutôt qu’une seule longue.
Faut-il une échelle oui ou non ou une échelle de 1 à 5 ?
Utilisez oui ou non pour les étapes qui ont eu lieu ou pas, comme la vérification d’identité ou une mention obligatoire. Utilisez une échelle à trois niveaux (atteint, partiellement atteint, non atteint) pour les comportements qui ont de vrais degrés, comme la complétude de la réponse. Les échelles à cinq points ne valent la peine que si chaque point a sa propre description écrite.
À quelle fréquence mettre à jour la grille ?
Revoyez la grille quand les produits, les règles ou les motifs de contact changent, et au moins quelques fois par an. Modifiez un critère à la fois et notez la date, car chaque changement déplace les notes et rend plus difficile la comparaison des tendances avant et après.
Peut-on utiliser une grille de critères qualité pour les agents IA ?
Oui. La même grille peut évaluer les conversations traitées par un agent IA et par des personnes, ce qui garde la qualité comparable entre les deux. Les critères doivent être observables dans la transcription, ce qui est de toute façon une bonne pratique pour l’évaluation humaine.