Een rubric voor kwaliteitsmonitoring (in het Engels QA rubric, ook wel beoordelingsrubric of set beoordelingscriteria) is de verzameling criteria waarmee een supportteam een klantgesprek scoort, met een beschrijving van hoe elk beoordelingsniveau eruitziet en hoe zwaar elk criterium telt. De rubric vertaalt “goede service” naar losse punten die twee reviewers op dezelfde manier kunnen beoordelen, en vormt de logica achter elke QA-score.
In het kort
- Een QA-rubric bestaat uit vijf onderdelen: criteria, een beoordelingsschaal, niveaubeschrijvingen, wegingen en een korte lijst kritieke punten.
- De niveaubeschrijvingen maken er een rubric van in plaats van een checklist, omdat ze reviewers vertellen wat “deels behaald” echt betekent.
- De QA-score is het aantal behaalde punten gedeeld door het aantal mogelijke punten, en hoe je met “niet van toepassing” omgaat, kan die score tien punten verschuiven.
- De meeste supportteams doen het goed met 5 tot 8 criteria die je alleen aan de hand van het transcript kunt controleren.
Wat een rubric voor kwaliteitsmonitoring bevat
Een rubric voor kwaliteitsmonitoring bevat vijf onderdelen: de criteria die worden beoordeeld, de beoordelingsschaal per criterium, een geschreven beschrijving van elk niveau op die schaal, een weging die bepaalt hoe zwaar elk criterium telt, en een paar kritieke punten waarop het gesprek direct zakt. Haal er één weg en reviewers vullen het gat op met hun persoonlijke oordeel.
Het woord komt uit het onderwijs. Het onderwijscentrum van Carnegie Mellon University definieert een rubric als “een beoordelingsinstrument dat de prestatieverwachtingen voor een opdracht expliciet weergeeft” (in het Engels) en merkt op dat rubrics zorgen voor consistentie tussen beoordelaars in cursussen met meerdere beoordelaars. Een supportteam met tien reviewers heeft precies dat probleem.
| Onderdeel | Welke vraag het beantwoordt | Voorbeeld |
|---|---|---|
| Criterium | Wat beoordelen we? | “Het antwoord was juist en volledig” |
| Beoordelingsschaal | Hoeveel uitkomsten zijn er mogelijk? | Behaald, deels behaald, niet behaald, niet van toepassing |
| Niveaubeschrijvingen | Hoe ziet elke uitkomst eruit? | “Deels behaald: juist, maar er ontbreekt één nodig detail” |
| Weging | Hoe zwaar telt het? | 30 van de 100 punten |
| Kritiek punt | Waardoor zakt het hele gesprek? | Accountgegevens gedeeld voordat de identiteit was geverifieerd |
Kritieke punten worden meestal knock-out criteria genoemd (in het Engels auto-fail): één misser zet de score op nul, wat er verder ook gebeurde. In software is de rubric de set criteria en beschrijvingen die scorecardsoftware voor QA op elk gesprek toepast.
QA-rubric, scorecard en checklist vergeleken
Een QA-rubric, een QA-scorecard en een QA-checklist beschrijven dezelfde activiteit op verschillende detailniveaus. De rubric is de beoordelingslogica, de scorecard is het formulier dat een reviewer invult, en een checklist is een lijst ja-of-nee-punten zonder niveaubeschrijvingen en meestal zonder wegingen. Veel teams gebruiken de woorden door elkaar.
| QA-checklist | QA-scorecard | QA-rubric | |
|---|---|---|---|
| Hoofdvraag | Is het gebeurd? | Welke score kreeg het? | Wat betekent elke score? |
| Beoordeling | Ja of nee | Ja of nee, of een schaal | Schaal met een beschrijving per niveau |
| Wegingen | Zelden | Meestal | Meestal |
| Het meest geschikt voor | Proces- en compliancestappen | Dagelijks beoordelen | Overeenstemming tussen reviewers, bezwaren, automatisering |
In de praktijk is je QA-scorecard de rubric plus het formulier eromheen: de link naar het gesprek, de reviewer, de opmerkingen en de eindscore. Heeft je scorecard criteria en wegingen, maar geen geschreven beschrijving van elk niveau, dan heb je een scorecard die nog zijn rubric mist.
Een voorbeeld van een QA-rubric voor chat- en e-mailsupport
Hier is een volledige QA-rubric voor schriftelijke support via chat en e-mail: zes gewogen criteria die samen 100 punten waard zijn, een schaal met drie niveaus en een beschrijving per niveau, en twee kritieke punten. Het is een voorbeeld om aan te passen, geen standaard. Stem de criteria af op je eigen producten, beleid en contactredenen.
| Criterium | Weging | Behaald (volle punten) | Deels behaald (helft) | Niet behaald (0) |
|---|---|---|---|---|
| Het echte probleem begrepen | 15 | Herhaalt het werkelijke probleem of handelt ernaar, stelt een verduidelijkende vraag als het verzoek dubbelzinnig is | Beantwoordt de letterlijke vraag, maar mist de onderliggende behoefte | Beantwoordt een andere vraag dan de gestelde |
| Juist en volledig antwoord | 30 | De informatie klopt en dekt alles wat de klant nodig heeft om verder te kunnen | Klopt, maar er ontbreekt één nodig detail | Onjuiste, verouderde of misleidende informatie |
| Het vereiste proces gevolgd | 20 | Elke vereiste stap voor deze contactreden is gedaan (restitutiebeleid, escalatiepad, tagging) | Een kleine stap is overgeslagen, zonder gevolgen voor de klant | Een vereiste stap is overgeslagen en de klant merkt het |
| Duidelijke volgende stap en termijn | 15 | Zegt wat er nu gebeurt, wie het doet en wanneer | Volgende stap genoemd, termijn ontbreekt | De klant moet raden wat er nu gebeurt |
| Toon past bij de situatie | 10 | Erkent frustratie als die er is, eenvoudige taal, geen schuld afschuiven | Beleefd, maar algemeen of als standaardtekst waar dat niet past | Afwijzend, verwijtend of verwarrend |
| Notities goed genoeg voor de volgende persoon | 10 | De interne notitie of ticketvelden laten een collega verder werken zonder de hele thread opnieuw te lezen | Er zijn notities, maar een belangrijk feit ontbreekt | Geen notities bij een gesprek dat een overdracht nodig heeft |
Kritieke punten (score wordt nul): account- of persoonsgegevens gedeeld voordat de identiteit was geverifieerd; een terugbetaling of tegoed beloofd buiten het beleid.
Twee dingen maken hier een rubric van in plaats van een lijst. Elk niveau heeft een beschrijving die een reviewer in het transcript kan aanwijzen, en “notities” kan op niet van toepassing worden gezet als er geen overdracht nodig is. Kant-en-klare versies per kanaal vind je in onze templates voor QA-scorecards (in het Engels).
Hoe je een QA-score berekent met de rubric
Een QA-score is het aantal punten dat een gesprek heeft behaald, gedeeld door het aantal punten dat het had kunnen behalen, weergegeven als percentage. In de meeste opzetten vallen criteria die op niet van toepassing staan uit beide getallen, en een kritiek punt zet de score op nul. Het gemiddelde van die scores over gesprekken heen geeft de kwaliteitsscore van een medewerker of team.
Neem één e-mail die met de rubric hierboven is gescoord:
| Criterium | Weging | Beoordeling | Punten |
|---|---|---|---|
| Het echte probleem begrepen | 15 | Behaald | 15 |
| Juist en volledig antwoord | 30 | Deels behaald | 15 |
| Het vereiste proces gevolgd | 20 | Behaald | 20 |
| Duidelijke volgende stap en termijn | 15 | Niet behaald | 0 |
| Toon past bij de situatie | 10 | Behaald | 10 |
| Notities voor de volgende persoon | 10 | Niet van toepassing | vervalt |
Het gesprek behaalde 60 van de mogelijke 90 punten, dus de score is 67%. Kijk wat de regel voor “niet van toepassing” doet. Als het team het als niet behaald telde, zou de score 60 van de 100 zijn, oftewel 60%. Telde het als behaald, dan 70 van de 100, oftewel 70%. Hetzelfde gesprek, tien punten verschil, puur door een regel die niemand heeft opgeschreven.
Daarom hoort de regel voor niet van toepassing in de rubric zelf. De wegingen zijn net zo belangrijk: een misser in toon kost hier 5 punten, een verkeerd antwoord tot 30. Onze gids over het wegen van beoordelingscriteria laat zien hoe je die getallen op basis van bewijs vaststelt, en het artikel over de interne kwaliteitsscore legt uit hoe de scores per gesprek optellen tot één teamcijfer.
Analytisch of holistisch: een format kiezen
Er zijn twee formats voor een rubric. Een analytische rubric scoort elk criterium afzonderlijk en combineert ze daarna, en dat doet bijna elke QA-rubric in support. Een holistische rubric geeft één totaaloordeel op basis van één beschrijving van kwaliteit. Een analytische rubric kost meer tijd om op te bouwen, maar vertelt de medewerker precies welk deel van het gesprek beter moet.
Het assessmentbureau van de University of Oklahoma vat de afweging samen: bij een analytische rubric “kan elk criterium worden gewogen om het relatieve belang van elke dimensie weer te geven” (in het Engels), terwijl bij een holistische rubric “criteria niet kunnen worden gewogen”. Dezelfde pagina merkt op dat analytische rubrics meer tijd kosten om te ontwikkelen en toe te passen.
Voor supportteams is de keuze meestal eenvoudig:
- Kies analytisch voor QA van medewerkers, coaching en alles wat aan een doel of bonus is gekoppeld. Medewerkers moeten weten welk criterium hen punten heeft gekost.
- Kies holistisch voor snelle gezondheidschecks, bijvoorbeeld als een manager een reeks gesprekken als “goed, kan beter, slecht” beoordeelt om een probleem te zien voordat er een volledige rubric is.
Welke kwaliteitscriteria in een rubric horen
Een criterium hoort in een QA-rubric als het vier tests doorstaat: een reviewer kan het in het gesprek zien, het controleert één ding, de medewerker heeft het zelf in de hand, en het past bij het type contact dat wordt gescoord. Criteria die deze tests niet doorstaan, leveren de scores op waartegen medewerkers het vaakst bezwaar maken, omdat twee eerlijke reviewers tot een ander oordeel kunnen komen.
- Waarneembaar. “Toonde empathie” is een gevoel. “Erkende eerst de frustratie van de klant en gaf daarna antwoord” is iets wat je kunt citeren.
- Eén controle per criterium. “Begroette de klant en verifieerde de identiteit” zijn twee criteria. Splits alles wat met “en” is verbonden.
- In de hand van de medewerker. Een trage tool of een beleid dat de medewerker niet kan veranderen, mag hem of haar geen punten kosten. Volg het in plaats daarvan als procesprobleem.
- Past bij de contactreden. Een band opbouwen is zinvol bij een klacht en nauwelijks bij een wachtwoordreset. In een Reddit-thread over QA-scores klaagde een medewerker van een energieleverancier dat hij werd gescoord op “de klant meenemen op een reis” terwijl de klant alleen een betaling wilde doen.
Wat het aantal betreft, houden de meeste mensen uit de praktijk het bij een korte lijst. Iemand in een Reddit-thread over het opnieuw opbouwen van QA in een spreadsheet raadde aan een rubric terug te brengen tot “5 tot 7 criteria” en “de meeste te laten controleren aan de tekst van het ticket”. Wil je het scoren automatiseren, dan ligt de lat nog hoger; onze gids over hoe je criteria schrijft die een AI kan scoren (in het Engels) herschrijft gangbare vage criteria tot controleerbare.
In zes stappen een rubric voor kwaliteitsmonitoring opbouwen
Een QA-rubric opbouwen gaat in zes stappen: kies de uitkomsten die de rubric moet beschermen, maak een lijst van het gedrag dat daartoe leidt, schrijf elk gedrag als waarneembaar criterium, beschrijf elk beoordelingsniveau, leg wegingen en kritieke punten vast, en test de rubric daarna met meerdere reviewers op echte gesprekken voordat medewerkers ook maar één score zien.
- Begin bij de uitkomsten. Schrijf de drie of vier dingen op die een goed gesprek voor je bedrijf moet opleveren: een juist antwoord, een opgelost probleem, een proces dat aan de regels voldoet, een klant die weet wat er nu gebeurt.
- Maak een lijst van het gedrag erachter. Lees 20 tot 30 recente gesprekken, goede en slechte, en noteer wat medewerkers deden dat het verschil maakte.
- Schrijf de criteria. Maak van elk gedrag één waarneembare uitspraak met de vier tests hierboven.
- Beschrijf elk niveau. Schrijf per criterium op hoe behaald, deels behaald en niet behaald eruitzien, met een kort voorbeeld uit een echt transcript.
- Leg wegingen en kritieke punten vast. Geef de meeste punten aan wat klanten het meest schaadt. Beperk kritieke punten tot de twee of drie fouten waarover echt niet te onderhandelen valt.
- Test voor de uitrol. Laat drie of vier reviewers dezelfde tien gesprekken onafhankelijk van elkaar scoren en vergelijk. Waar ze het oneens zijn, is de beschrijving onduidelijk, niet de reviewer.
Stap 6 is de stap die teams overslaan. In een Reddit-thread over tools voor QA-scorecards beschreef iemand hoe twee reviewers hetzelfde ticket een 60 en een 85 gaven, omdat “toonde empathie” voor ieder iets anders betekende, en dat medewerkers daarna “het getal niet meer vertrouwden”. Regelmatige kalibratie in kwaliteitsmonitoring houdt dat gat na de start gedicht. Iemand die op dezelfde vraag reageerde in een tweede subreddit, maakte nog een praktisch punt: factuurtickets, bugescalaties en terugbetalingsverzoeken hebben mogelijk aparte rubrics nodig, omdat ze “geen criteria delen”.
Eén rubric toepassen op elk gesprek
Een rubric loont pas als hij op elk gesprek op dezelfde manier wordt toegepast, en daar loopt handmatige beoordeling vast. Een reviewer die een kleine steekproef leest, kan bij grote volumes niet consistent scoren, en elke reviewer wijkt na verloop van tijd een beetje af. Geautomatiseerd scoren past één geschreven standaard op alle gesprekken toe, zonder dat iemand moe is of haast heeft.
Kaizo neemt je bestaande criteria over in plaats van een template op te leggen, en scoort 100% van je supportgesprekken daarop, of nu een mens of een AI-agent antwoordde, met het bewijs gekoppeld aan elke score. Pas je de beschrijving van een criterium aan, dan geldt de wijziging voor elke toekomstige beoordeling, zodat niemand een team reviewers opnieuw hoeft te briefen. Bij UiPath automatiseerde Kaizo 100% van de QA met 200% ROI. Bij EverHelp (in het Engels) daalde de voorbereiding voor coaching met 75%.
Bekijk het op je eigen gesprekken. Kaizo scoort 100% van je supportgesprekken op basis van je eigen rubric en zet de bevindingen om in coaching. Boek een demo of bekijk hoe de scorecardsoftware voor QA werkt.
Wanneer een formele rubric niets voor jou is
Een volledige gewogen rubric met niveaubeschrijvingen is niet voor elk team de moeite waard. Als een of twee mensen een paar dozijn tickets per week afhandelen, dekt een manager die gesprekken leest en direct feedback geeft hetzelfde terrein met minder overhead. Een korte ja-of-nee-checklist volstaat tot er meningsverschillen over kwaliteit ontstaan.
Een rubric lost ook geen procesprobleem op. Als medewerkers over de hele linie op hetzelfde criterium zakken, ligt de oorzaak meestal bij een beleid, een tool of de training, en strenger scoren laat de scores alleen slechter ogen. Stel een rubric op als je meerdere reviewers hebt, medewerkers die vragen waarom ze punten verloren, of plannen om gesprekken automatisch te scoren.
Veelgestelde vragen
Wat betekent QA rubric?
QA rubric betekent de beoordelingsleidraad die een team voor kwaliteitscontrole gebruikt om klantgesprekken te scoren, in het Nederlands meestal rubric of beoordelingscriteria. Hij vermeldt de criteria, de beoordelingsschaal, hoe elk niveau eruitziet en hoe zwaar elk criterium telt. “Quality assurance rubric” en “quality scorecard” zijn gangbare namen voor hetzelfde.
Wat is een QA-score?
Een QA-score is het resultaat van de rubric toegepast op één gesprek: behaalde punten gedeeld door mogelijke punten, als percentage. Criteria die op niet van toepassing staan, vallen meestal uit beide getallen, en een kritiek punt zet de score op nul. Kwaliteitsscores van teams en medewerkers zijn gemiddelden van deze scores per gesprek.
Hoeveel criteria moet een QA-rubric hebben?
De meeste supportteams doen het goed met 5 tot 8 criteria, elk te controleren aan de hand van het transcript. Met minder dek je zelden juistheid, proces en communicatie samen af, en veel langere lijsten zijn traag om te beoordelen en lastig consistent te scoren. Teams met heel verschillende contacttypes houden vaak een korte rubric per type aan in plaats van één lange.
Gebruik je in een QA-rubric een ja-of-nee-schaal of een schaal van 1 tot 5?
Gebruik ja of nee voor stappen die wel of niet zijn gebeurd, zoals identiteitsverificatie of een verplichte mededeling. Gebruik een schaal met drie niveaus (behaald, deels behaald, niet behaald) voor gedrag met echte gradaties, zoals de volledigheid van een antwoord. Vijfpuntsschalen zijn alleen de moeite waard als elk punt een eigen geschreven beschrijving heeft.
Hoe vaak moet je een QA-rubric bijwerken?
Herzie de rubric als producten, beleid of contactredenen veranderen, en minstens een paar keer per jaar. Wijzig één criterium tegelijk en noteer de datum, want elke wijziging verschuift de scores en maakt trends van voor en na de wijziging lastiger te vergelijken.
Kun je een QA-rubric gebruiken voor AI-agents?
Ja. Dezelfde rubric kan gesprekken scoren die door een AI-agent en door mensen zijn afgehandeld, zodat de kwaliteit tussen beide vergelijkbaar blijft. De criteria moeten waarneembaar zijn in het transcript, wat voor menselijke beoordeling sowieso goede praktijk is.