Naar de inhoud

Metrics

Interne kwaliteitsscore (IQS) in de klantenservice

De interne kwaliteitsscore (IQS) meet supportkwaliteit aan je eigen standaarden. Lees de formule, wat een goede score is en hoe je een lage IQS verbetert.

· 14 min. lezen

Gecontroleerd door Dominik Blattner, oprichter van Kaizo

Op deze pagina

De IQS (interne kwaliteitsscore, in het Engels Internal Quality Score) is het percentage kwaliteitspunten dat je supportteam behaalt wanneer zijn gesprekken worden gescoord met je eigen QA-scorecard. Hij laat zien of medewerkers aan je standaarden voldeden, los van hoe klanten zich voelden.

In het kort

  • IQS = (behaalde punten / mogelijke punten) × 100.
  • De meeste gevestigde supportteams mikken op een IQS van 75 tot 85%.
  • Anders dan CSAT of NPS scheidt hij de prestaties van medewerkers van productproblemen.
  • Een kleine steekproef maakt de score onbetrouwbaar, dus dekking telt.

Je meet de CSAT al. Misschien ook de NPS. En toch vertelt geen van beide of je medewerkers echt het proces volgden, correcte antwoorden gaven of die boze klant goed hielpen. Een klant kan een lovende beoordeling achterlaten nadat een medewerker iets heeft beloofd wat je product niet kan.

Precies die kloof dicht de interne kwaliteitsscore.

Wat is de IQS in de klantenservice?

De Internal Quality Score (IQS) is een metric die de kwaliteit van de klantinteracties van je team meet aan standaarden die je zelf vastlegt. Een reviewer (of een AI) beoordeelt gesprekken met een QA-scorecard, en de samengevoegde resultaten worden één percentage.

Het woord “intern” is de kern. CSAT vraagt klanten hoe ze zich voelden. IQS vraagt: deden we wat wij zeggen dat kwaliteit is? Jij bepaalt de criteria, jij stelt de wegingen vast en jij bent eigenaar van de standaard.

Even over de terminologie, want “IQS betekenis” zorgt voor verwarring: de auto-industrie gebruikt IQS voor de Initial Quality Study van J.D. Power, die gebreken aan nieuwe auto’s meet. Een heel andere metric. Kom je voor de klantenservice, dan zit je hier goed.

IQS-scores uit QA-scorecards in Kaizo

Waar staat de afkorting IQS voor?

IQS staat voor Internal Quality Score, oftewel interne kwaliteitsscore. Sommige teams noemen hem de interne kwaliteitscontrolescore of gewoon de QA-score; het gaat steeds om hetzelfde: een percentage dat uitdrukt hoe goed beoordeelde gesprekken aan je kwaliteitscriteria voldeden. Hoor je in een contactcenter “kwaliteitsscore” zonder nadere uitleg, dan wordt meestal deze metric bedoeld.

Hoe verschilt de IQS van CSAT, NPS en CES?

Elke metric beantwoordt een andere vraag, en ze zijn niet uitwisselbaar.

MetricWelke vraag hij beantwoordtWie de data levertBlinde vlek
IQSVoldeed ons team aan onze kwaliteitsstandaarden?Interne reviewers of AIMeet de emotie van de klant niet rechtstreeks
CSATWas de klant tevreden over deze interactie?KlantenBeïnvloed door productproblemen, prijzen, stemming; lage responspercentages
NPSZou de klant ons aanbevelen?KlantenMeet het hele merk, niet de support
CESHoe makkelijk was het om hulp te krijgen?KlantenZegt niets over juistheid of compliance

Het praktische verschil: als de CSAT daalt, weet je dat er iets mis is, maar niet wat. Als de IQS daalt, zie je precies welk criterium faalde, in welk team en in welk kanaal. Daarom werken ze samen het best. Combineer ze en je ziet de gesprekken waarin de klant tevreden was maar de medewerker een fout antwoord gaf, of waarin de medewerker alles goed deed en de klant toch gefrustreerd bleef door het product. Hoe deze metrics op elkaar inwerken, lees je in onze gids over KPI’s in de klantenservice.

Daarachter zit ook een grotere verschuiving. Onderzoek van Gartner uit juni 2024 liet zien dat van de serviceleiders die hun QA-programma als zeer waardevol beoordelen, 52% dat vooral toeschrijft aan inzichten in de stem van de klant, terwijl maar 19% de prestaties van medewerkers noemt. Kwaliteitsscores zijn al een tijd niet meer alleen een HR-instrument.

Hoe bereken je de interne kwaliteitsscore?

De formule zelf is eenvoudig:

IQS = (behaalde punten / mogelijke punten) × 100

In woorden: deel de punten die een gesprek behaalde door de punten die het had kunnen behalen, en vermenigvuldig met 100. Voor een team- of medewerkersscore neem je het gemiddelde van dat percentage over alle beoordeelde gesprekken.

Het werk zit in wat erachter zit. Dit is het proces dat de meeste teams volgen.

1. Leg de criteria van je scorecard vast

Groepeer je kwaliteitsstandaarden in categorieën. De klassiekers:

  • Afhandeling van de case: Gaf de medewerker correcte en volledige informatie? Escaleerde hij wanneer dat nodig was?
  • Supportvaardigheden: Toonde hij empathie? Paste hij zich aan toen de vraag van de klant halverwege het gesprek veranderde?
  • Taal: grammatica, spelling, een toon die past bij je merkstem.
  • Kritieke fouten: gevoelige data delen, de verkeerde klant aanspreken, een compliance-regel overtreden.

Onze checklist voor kwaliteitscontrole in de klantenservice bevat een volledige set voorbeeldcriteria die je kunt overnemen.

2. Weeg de criteria

Niet elke fout is gelijk. Een typfout kost een punt; persoonsgegevens lekken zou de hele beoordeling moeten laten zakken. De meeste teams maken van kritieke fouten een automatische onvoldoende, terwijl soft skills een gemiddeld gewicht krijgen. Deze wegingen goed krijgen is belangrijker dan het aantal criteria, dus bekijk ze elk kwartaal opnieuw. In Kaizo dragen scorecards deze wegingen en kun je ze per team, wachtrij of klant inzetten. Onze gids voor het opzetten van een QA-scorecard gaat dieper in op wegingen.

3. Scoor gesprekken en voeg de resultaten samen

Reviewers beoordelen tickets met de scorecard. Stel dat een gesprek 42 van de 50 mogelijke punten behaalt: dan is de IQS voor dat ticket 84%. Neem het gemiddelde over alle beoordeelde gesprekken en je hebt je teamscore. Splits hem uit per medewerker, team, kanaal of periode.

Uitgewerkt voorbeeld. Je scorecard heeft vier categorieën van elk 25 punten. Een medewerker scoort 25 (afhandeling van de case), 20 (supportvaardigheden), 22 (taal) en 25 (geen kritieke fouten). Dat is 92 van de 100 punten, dus dit gesprek scoort 92%. Doe dit over 200 beoordeelde tickets en het gemiddelde, zeg 81%, is je maandelijkse IQS.

Doe je QA in een spreadsheet, dan wordt juist dit samenvoegen pijnlijk. Tools die hiervoor gebouwd zijn, doen het automatisch. In Kaizo bijvoorbeeld zet een QA-beheerder de scorecard één keer op, beoordeelt elke reviewer op dezelfde criteria en wordt de IQS per medewerker, team en periode samengevat in dashboards (in het Engels) zonder dat iemand een formule aanraakt.

Auto QA beoordeelt een supportticket in Kaizo

4. Kalibreer je reviewers

Twee reviewers die hetzelfde ticket scoren, horen op hetzelfde resultaat uit te komen. In het begin gebeurt dat meestal niet. Regelmatige kalibratiesessies, waarin meerdere reviewers identieke gesprekken scoren en hun bevindingen vergelijken, maken van de IQS een metric in plaats van een mening. Sla je die over, dan meet je score de stemming van de reviewer, niet de kwaliteit van het gesprek.

Wat is een goede IQS?

Kort antwoord: dat hangt af van hoe streng je scorecard is. Een 95% op een milde scorecard zegt minder dan een 80% op een veeleisende. Toch zijn er bruikbare referentiepunten:

  • 75 tot 85% is waar de meeste gevestigde supportteams hun doel leggen.
  • Boven 90% wijst meestal op een uitstekend team of op een scorecard die te makkelijk is. Controleer welke van de twee het is voordat je het viert.
  • Onder 70% wijst doorgaans op een trainingstekort, onduidelijke processen of criteria die niet bij de werkelijkheid passen.

De trend is belangrijker dan het absolute getal. Een IQS die in twee kwartalen van 78% naar 84% gaat, vertelt je dat coaching werkt. Een stabiele 90% vertelt je niets, behalve dat niemand goed kijkt.

Vergelijk jezelf eerst met je eigen historie en pas daarna met cijfers uit de sector. Scorecards verschillen zo sterk tussen bedrijven dat vergelijkingen tussen bedrijven je flatteren of straffen om redenen die niets met kwaliteit te maken hebben.

Overzicht van de interne kwaliteitsscore in Kaizo

Verandert de IQS in de loop van de tijd?

Ja, en een stabiele IQS is juist het verdachte geval. Verwacht beweging vanuit vier richtingen:

  • Nieuwe medewerkers. Een lichting nieuwe medewerkers trekt de IQS van het team doorgaans een kwartaal lang 5 tot 10 punten omlaag. Dat is geen kwaliteitsprobleem, het is een inwerkcurve. Volg lichtingen apart, zodat een wervingsgolf niet overkomt als een achteruitgang van het team.
  • Wijzigingen in de scorecard. Telkens wanneer je een criterium toevoegt, verwijdert of opnieuw weegt, verandert de betekenis van je IQS. Noteer scorecardwijzigingen op de tijdlijn van je rapportage, anders jaag je volgend jaar op een “daling” die in werkelijkheid een strengere scorecard was.
  • Seizoensinvloeden. Piekperiodes drukken de afhandeltijd en verdelen medewerkers over meer gesprekken. De meeste teams zien in hun drukke seizoen een meetbare dip in de IQS. Plan coaching (in het Engels) ervoor, niet tijdens.
  • Score-inflatie. Reviewers worden na verloop van tijd milder, vooral wanneer ze maand na maand dezelfde medewerkers scoren. Stijgt je IQS gestaag terwijl de CSAT vlak blijft, dan is inflatie een waarschijnlijkere verklaring dan verbetering. Kalibratiesessies zijn het correctiemechanisme.

De praktische les: beoordeel de IQS als een trend met context, nooit als één losstaand getal. Een schommeling van 4 punten betekent niets in een maand waarin je zes medewerkers inwerkte en een nieuwe scorecard invoerde.

Waar komen de data voor de IQS vandaan?

Drie lagen voeden de score:

  1. De gesprekken zelf. Tickets, e-mails, chats en opnames of transcripties van telefoongesprekken, opgehaald uit je helpdesk of contactcenterplatform. Dit is het ruwe materiaal.
  2. De scorecard. Je criteria, wegingen en voorwaarden voor een automatische onvoldoende. Die maakt van een gesprek punten.
  3. De beoordelingen. Een menselijke reviewer, een AI of beide, die de scorecard op elk gesprek toepassen. Wie er ook beoordeelt, de uitkomst is dezelfde: behaalde punten per criterium, per gesprek.

Wat de IQS bewust niet gebruikt: antwoorden op klantenquêtes. Die scheiding is juist de kracht. CSAT vertelt je hoe de klant zich voelde; IQS vertelt je wat je team deed. Meng je die twee databronnen, dan kun je die twee verhalen niet meer uit elkaar houden.

Waarom is de IQS belangrijk?

Afgezien van “kwaliteit is goed” verdient de IQS om concrete redenen een plek op je dashboard:

  • Hij isoleert supportprestaties van productproblemen. Klanten beoordelen hun hele ervaring. Frustreert je product ze, dan daalt de CSAT, ook als medewerkers uitstekend werk leveren. De IQS filtert die ruis eruit.
  • Hij maakt coaching concreet. Een lage CSAT zegt “verbeter je”. Een lage IQS op het escalatiecriterium zegt “train het team op wanneer je escaleert”. Alleen met het tweede kun je iets. Het doel van QA in een callcenter is precies die vertaling van score naar actie.
  • Hij vangt problemen op voordat klanten dat doen. Compliancefouten en verkeerde antwoorden duiken op in QA-reviews voordat ze opduiken in klantverloop.
  • Hij geeft je bewijs voor gesprekken over bezetting en budget. “De kwaliteit daalde 6 punten nadat we het trainingsprogramma schrapten” is een argument dat de directie begrijpt.

Het steekproefprobleem: wanneer je IQS liegt

Dit is het ongemakkelijke deel dat de meeste IQS-gidsen overslaan.

Een typisch QA-team beoordeelt 3 tot 5 tickets per medewerker per week. Voor een team met echt volume is dat ergens tussen 1 en 5% van alle gesprekken. Je IQS, het getal op het directiedashboard, beschrijft een piepkleine steekproef. De overige 95%+ ligt in een grijze zone waar niemand naar heeft gekeken.

Kleine steekproeven leiden tot twee concrete problemen:

  1. Statistische ruis. Met vijf beoordeelde tickets verschuift één slecht gesprek de score van een medewerker met 20 punten. Je coacht dan mensen op toeval, niet op prestaties.
  2. Selectiebias. Reviewers kiezen vaak tickets die makkelijk te vinden zijn of al gemarkeerd zijn. De stille fouten, het verkeerde antwoord dat vriendelijk wordt gegeven, komen nooit in de steekproef terecht.

Hoe groot is het ruisprobleem? Dit is de foutmarge bij een IQS rond 80%, per maandelijks reviewvolume:

Beoordeelde gesprekken per maandJe “echte” IQS kan ernaast zitten met
25±16 punten
50±11 punten
100±8 punten
250±5 punten
500±3,5 punten
Elk gesprek0: je meet, je schat niet

Bij 25 reviews per maand is een gerapporteerde IQS van 80% statistisch verenigbaar met alles tussen 64% en 96%. De meeste teams die een verbetering van 3 punten vieren, kijken naar ruis.

De handmatige oplossing is meer tickets beoordelen, de selectie goed randomiseren en de kosten accepteren. Sommige teams doen precies dat, en voor een klein team kan dat genoeg zijn.

De structurele oplossing is automatisering. AI-gebaseerde auto QA beoordeelt elk gesprek met je scorecard in plaats van een steekproef, waardoor de IQS van een schatting een meting wordt. Die kant gaat de categorie op: de geautomatiseerde QA van Kaizo scoort elk ticket met je scorecard, en kalibratiesessies houden reviewers en de AI op dezelfde standaard, zodat de score een consistente standaard weerspiegelt in plaats van het oordeel van één beoordelaar op een bepaalde dag. Dekking verandert waarop de score is gebaseerd. Kalibratie verandert of je kunt vertrouwen op wat hij zegt.

Twijfel je tussen de handmatige en de geautomatiseerde aanpak, dan gaat onze vergelijking van workflows voor geautomatiseerde kwaliteitscontrole dieper in op de keuze.

Hoe verbeter je een lage IQS?

Een lage score is een startpunt, geen vonnis. De volgorde die werkt:

Zoek het criterium dat faalt, niet de medewerker die faalt. Mist de helft van het team hetzelfde criterium, dan ligt het probleem bij een proces of bij het criterium zelf. Repareer het systeem voordat je individuen coacht.

Coach met bewijs. Algemene feedback (“wees empathischer”) verandert niets. Koppel elk coachingpunt aan concrete gesprekken. Medewerkers accepteren feedback die ze kunnen zien. Onze gids over coaching in de klantenservice laat zien hoe je deze sessies opzet, en tools helpen hier ook: Kaizo maakt automatisch coachingkaarten uit QA-data, zodat teamleiders hun tijd aan coachen besteden in plaats van aan verzamelen.

Meet opnieuw na 30, 60 en 90 dagen. Coaching zonder nieuwe meting is een suggestie. Volg of het criterium waar je op stuurt in de volgende cyclus echt verbetert.

Bekijk de scorecard zelf twee keer per jaar. Standaarden verschuiven. Kanalen veranderen. Een scorecard die voor e-mail-QA is geschreven, meet chatgesprekken slecht. Kwaliteitscontrole is een levend proces, geen eenmalige inrichting; het verschil tussen kwaliteitsborging en kwaliteitscontrole doet er hier toe.

Voorbeeldcriteria van een QA-scorecard in Kaizo

Een gratis IQS-scorecardtemplate om te kopiëren

Gebruik dit als vertrekpunt. Vier categorieën, 100 punten, één regel voor een automatische onvoldoende.

CategorieCriteriumPunten
Afhandeling van de case (35)Correcte en volledige oplossing gegeven20
Afhandeling van de caseJuiste escalatie of opvolging gestart wanneer nodig10
Afhandeling van de caseInterne notities en tags volledig5
Supportvaardigheden (30)Het echte probleem van de klant erkend10
SupportvaardighedenEmpathie en toon passend bij de situatie10
SupportvaardighedenAangepast toen de vraag veranderde10
Taal (15)Grammatica en spelling5
TaalHeldere opbouw, geen jargon5
TaalMerkstem5
Proces (20)Gedocumenteerde procedure gevolgd10
ProcesJuiste macro’s/templates gebruikt5
ProcesAfgehandeld binnen de SLA5
Kritieke fout (automatische onvoldoende)Verkeerde klantdata gedeeld, beveiligings- of compliance-inbreukScore = 0

Pas de wegingen aan je eigen situatie aan. Een fintech zou proces en compliance zwaarder moeten wegen; een e-commerceteam kan meer punten naar de afhandeling van de case schuiven. De regel voor een automatische onvoldoende is het enige onderdeel dat we in elke versie zouden houden: sommige fouten horen niet weggemiddeld te worden.

Hoe rapporteer je de IQS aan de directie?

De fout is het getal los te rapporteren. Een IQS van 82% zegt een directielid niets zonder context. Wat werkt:

  • Trend plus annotatie. De IQS-lijn over 6 maanden, met scorecardwijzigingen en wervingsgolven erop aangegeven.
  • Combineer hem met de CSAT. De twee lijnen samen beantwoorden de vraag die de directie echt heeft: drijft kwaliteit de tevredenheid?
  • Eén falend criterium, één actie. “Escalatieafhandeling scoorde dit kwartaal 61%; we geven gerichte coaching en meten over 30 dagen opnieuw” werkt beter dan een dashboard met veertig getallen.
  • Vermeld de dekking. Geef aan op welk percentage van de gesprekken de score is gebaseerd. Het is het belangrijkste transparantiesignaal in een QA-rapport, en bijna niemand neemt het op.

Verder lezen

Veelgestelde vragen

Waar staat IQS voor?

In de klantenservice staat IQS voor Internal Quality Score (interne kwaliteitsscore): het percentage kwaliteitspunten dat je team behaalt over beoordeelde gesprekken. (In de auto-industrie verwijst dezelfde afkorting naar de Initial Quality Study van J.D. Power, die er niets mee te maken heeft.)

Wat is een goede QA-score?

De meeste supportteams mikken op een IQS tussen 75 en 85%. Bij scores boven 90% verdient de moeilijkheid van de scorecard een kritische blik, en scores onder 70% wijzen meestal op tekorten in training of processen in plaats van op slechte medewerkers.

Hoe wordt de IQS berekend?

Deel de behaalde kwaliteitspunten door de mogelijke punten en vermenigvuldig met 100. Een ticket dat 42 van de 50 punten scoort, heeft een IQS van 84%. De team-IQS is het gemiddelde over alle beoordeelde gesprekken.

Hoeveel tickets moet je beoordelen voor een betrouwbare IQS?

Meer dan bijna iedereen handmatig doet. Bij 3 tot 5 tickets per medewerker per week neem je een steekproef van minder dan 5% van de gesprekken, waardoor individuele scores onbetrouwbaar zijn. Vergroot en randomiseer je steekproef, of gebruik AI-gebaseerde software voor kwaliteitsmonitoring om elk gesprek te beoordelen.

Is de IQS beter dan de CSAT?

Geen van beide vervangt de ander. CSAT meet hoe klanten zich voelen; IQS meet of je team aan je standaarden voldeed. Samen laten ze zien waar die twee uit elkaar lopen, en juist daar zitten meestal de interessante problemen.

Wat maakt een IQS betrouwbaar?

De scorecard en de consistentie van het scoren eronder. Een IQS is een samenvatting, en een samenvatting is maar zo goed als wat ze samenvat: zijn de criteria vaag en scoren reviewers ze verschillend, dan meet de IQS de mening van de reviewer in plaats van kwaliteit. Een betrouwbare IQS rust op heldere criteria, gekalibreerde reviewers en bij voorkeur volledige dekking in plaats van een kleine steekproef, en is terug te voeren tot het criterium en het gesprek, zodat een beweging in het getal een concrete bevinding wordt waarop je kunt coachen.

Veranderen IQS-scores in de loop van de tijd?

Ja. Lichtingen nieuwe medewerkers, scorecardwijzigingen, seizoensvolume en drift bij reviewers bewegen allemaal de score. Beoordeel de trend met context in plaats van het getal van één maand.

Wat is de volledige naam van IQS?

IQS is de Internal Quality Score, soms de interne kwaliteitscontrolescore genoemd: het percentage kwaliteitspunten dat wordt behaald over beoordeelde klantgesprekken.

Meet wat je echt kunt zien

De IQS is de enige supportmetric die je volledig zelf in de hand hebt: jouw standaarden, jouw scorecard, jouw definitie van goed. Die controle is ook het risico, want een score die rust op een dunne steekproef en ongekalibreerde reviewers geeft je ruis die er zelfverzekerd uitziet.

Zorg eerst dat de basis klopt. Heldere criteria, eerlijke wegingen, gekalibreerde reviewers. Vergroot daarna je dekking, want elk gesprek dat je niet beoordeelt, is een datapunt waar je naar gist.

Wil je zien hoe de IQS eruitziet bij 100% dekking? Boek een demo en we laten het je zien op je eigen tickets.

Op deze pagina

Zie dit op je eigen gesprekken

We scoren een steekproef van je echte tickets op basis van jouw standaarden, zodat het voorbeeld van jou is.

Vertrouwd door internationale supportteams

  • Foot Locker
  • SteelSeries
  • Canva
  • GetYourGuide
  • Instacart