Naar de inhoud

Overzicht

Conversation intelligence software: een koopgids

Conversation intelligence software kiezen: een checklist van functies, een pilotplan op je eigen data, de prijsmodellen en de koopfouten die een jaar kosten.

· 15 min. lezen

Gecontroleerd door Dominik Blattner, oprichter van Kaizo

Op deze pagina

Conversation intelligence software scoort en analyseert 100% van de klantgesprekken over telefonie, chat, e-mail en messaging. Kies er een met een pilot op je eigen gesprekken, gescoord tegen je eigen criteria en vergeleken met wat je reviewers concludeerden.

In het kort

  • Tools voor het opnemen van salesgesprekken dragen hetzelfde label, maar lossen een ander probleem op.
  • Zwakke transcriptie van je eigen audio maakt elke latere score onbetrouwbaar.
  • Sta op je eigen beoordelingscriteria, met bewijs gekoppeld aan elke score.

Wat conversation intelligence software doet, in één sectie

Conversation intelligence software luistert naar je klantgesprekken en leest ze, zet ze om in gestructureerde, doorzoekbare data en voert daar analyses op uit: scoren, sentiment, intentie, onderwerpen en trends herkennen, en waarschuwingen sturen. De volledige uitleg over hoe die onderliggende pipeline werkt staat in de gids over conversation intelligence (in het Engels), en de korte definitie in wat is conversation intelligence (in het Engels). Deze pagina gaat ervan uit dat je al weet wat het is en wilt beslissen welke je koopt.

Voor een koopbeslissing is belangrijk dat de categorie bovenop een aantal oudere, smallere categorieën ligt. Speech analytics (in het Engels) dekt de telefoniekant. Text analytics (in het Engels) dekt chat, e-mail en messaging. Interaction analytics (in het Engels) en conversation analytics (in het Engels) zijn naaste buren waarmee verschillende leveranciers een net iets andere reikwijdte bedoelen. Zegt een salesteam dat een product conversation intelligence doet, vraag dan welke van die lagen het zelf bouwt en voor welke het met een partner werkt. Het antwoord verandert de prijs, de nauwkeurigheid en de implementatie meer dan welke functie op een slide ook. Enterprisesuites zoals Verint en Cresta bundelen meerdere van die lagen.

Een handig kader: de software moet drie taken na elkaar uitvoeren, en een zwakte in de eerste taak vergiftigt de rest. Ze moet getrouw vastleggen en transcriberen, ze moet juist interpreteren wat er gebeurde, en ze moet die interpretatie bij een mens krijgen die ernaar kan handelen. De meeste teleurstellende implementaties falen bij taak één of taak drie, niet bij taak twee.

Conversation intelligence voor CX is geen opnamesoftware voor sales

Zoek op conversation intelligence software en ongeveer de helft van de resultaten zijn tools voor salesteams. Ze nemen uitgaande gesprekken op, labelen spreektijdverhoudingen en het omgaan met bezwaren, en voeden een omzetprognose. Voor die taak zijn het goede producten. Voor een supportorganisatie zijn ze de verkeerde aankoop, en die verwarring kost teams echt geld.

De verschillen die ertoe doen als je koopt

Salesgerichte tools zijn gebouwd voor telefonie, omdat salesgesprekken nu eenmaal telefoongesprekken zijn. Support meestal niet: tickets, chat, e-mail en messaging zijn doorgaans het grootste deel van het volume, dus een architectuur die op telefonie gebouwd is laat de meeste van je gesprekken ongeanalyseerd. Salestools zijn geoptimaliseerd om een klein team van waardevolle verkopers te coachen op een handvol gesprekken per week. Support heeft dekking nodig over honderden medewerkers en tienduizenden gesprekken, en dat is een heel ander schaalprobleem.

Het diepste verschil is de eenheid van beoordeling. Conversation intelligence voor sales vraagt of de verkoper de deal verder bracht. Conversation intelligence voor CX vraagt of het gesprek aan je kwaliteitsnorm voldeed: werd de klant geverifieerd, werd het beleid gevolgd, was de informatie juist, werd het probleem echt opgelost, was de toon goed. Dat betekent dat de CX-versie een echte scoring-engine moet hebben die gekoppeld is aan beoordelingscriteria die van je eigen bedrijf zijn, plus een proces voor bezwaren en kalibratie, omdat scores die aan mensen hangen eerlijk moeten zijn. Kan een product je geen configureerbare scorecard en geen spoor van bewijs laten zien, dan is het een salestool met een supportlabel erop.

De checklist van functies

Gebruik dit als scoreblad voor elke leverancier op je shortlist. De rechterkolom is de versie van de vraag die moeilijk met marketingtaal te beantwoorden is, dus stel hem in die vorm en noteer de specifieke details in plaats van de geruststellingen.

FunctieWaarom het teltVraag aan de leverancier
Nauwkeurigheid van de transcriptieElke score, trend en zoekresultaat komt voort uit de transcriptie. Fouten stapelen zich ongemerkt op.Wat is je word error rate op onze talen, accenten en audiokwaliteit, gemeten op onze opnames in plaats van op die van jou?
Scheiding van sprekersZonder betrouwbare diarisatie weet je niet wie wat zei, en is scoren per medewerker giswerk.Hoe ga je om met door elkaar praten, doorverbindingen, gesprekken met drie partijen en een slechte lijn?
Dekking van kanalenHet supportvolume is grotendeels tekst. Een tool die alleen telefonie doet, analyseert een minderheid van je gesprekken.Welke kanalen worden native ondersteund, en is de analyse in alle kanalen gelijk of alleen voor telefonie gebouwd?
Zoeken in gesprekkenDe dagelijkse waarde is een vraag in minuten beantwoorden in plaats van na een week handmatig lezen.Kan ik tegelijk zoeken op zinsdeel, intentie, uitkomst en metadata, en hoe actueel is de index?
Scoren tegen je eigen criteriaEen vast template van de leverancier meet het idee van kwaliteit van de leverancier, niet dat van je bedrijf.Kan ik mijn eigen scorecard bouwen, wegen en versioneren, en verschillende criteria gebruiken per wachtrij of regio?
Scores gekoppeld aan bewijsOp een score die je niet kunt controleren, kun je niet coachen, kun je geen bezwaar maken, en medewerkers vertrouwen hem niet.Laat me een score zien en klik meteen door naar de exacte regels in het gesprek die hem opleverden.
Aantoonbare nauwkeurigheidNauwkeurigheid die je niet op je eigen data kunt controleren, is een bewering en geen meting.Kunnen we je scoring laten lopen op 200 gesprekken die onze reviewers al beoordeeld hebben, en de mate van overeenstemming en de verschillen zien?
Sentiment en intentieVertelt je waarom klanten contact opnemen en hoe het voelde, niet alleen hoeveel.Hoe wordt sentiment bepaald, hoe wordt het gevalideerd, en kan ik eigen intenties voor mijn bedrijf definiëren?
Onderwerpen en trends herkennenBrengt nieuwe problemen aan het licht voordat ze in CSAT of het ticketvolume zichtbaar worden.Ontdekt het zelf nieuwe onderwerpen, of matcht het alleen met een lijst die ik bijhoud?
CoachingworkflowEen inzicht dat geen medewerker bereikt, verandert niets.Wat gebeurt er tussen een lage score en een coachingsgesprek, binnen het product, zonder exports?
WaarschuwingenSommige fouten vragen vandaag een reactie, niet pas in het maandrapport.Wat kan een waarschuwing triggeren, waar komt die terecht, en hoe voorkom ik dat iedereen afstompt door te veel meldingen?
IntegratiesEen apart systeem waar niemand inlogt, wordt binnen een kwartaal links gelaten.Is dit native in onze helpdesk en CRM, of een export, een synchronisatietaak of een iframe?
Beveiliging en dataresidentieKlantgesprekken zijn een van de gevoeligste soorten data die je hebt.Waar wordt data opgeslagen en verwerkt, welke certificeringen heb je, wordt onze data gebruikt om modellen te trainen, en wat is het verwijderbeleid?

De vier functies die kopers onderschatten

De meeste shortlists gaan op elkaar lijken, omdat elke leverancier elke rij hierboven claimt. In deze vier zitten de echte verschillen.

Kwaliteit van transcriptie en diarisatie op je eigen audio

Claims over nauwkeurigheid worden gemeten op schone, Engelstalige benchmarkaudio met één spreker. Jouw werkelijkheid is achtergrondgeluid, regionale accenten, anderstalige sprekers, productjargon en klanten die door medewerkers heen praten. Vraag een test op twintig van je eigen slechtste opnames en lees de transcripties zelf. Let vooral op productnamen, ordernummers en ontkenningen, want een weggevallen “niet” draait de betekenis van een zin om en tast zowel sentiment als compliancecontroles ongemerkt aan.

Scoren tegen criteria die jij beheert

Het verschil tussen analyse en kwaliteitsmanagement is of het systeem gesprekken beoordeelt tegen een norm die je eigen bedrijf heeft vastgelegd. Zoek naar de mogelijkheid om eigen criteria te schrijven, ze te wegen, sommige als knock-outcriterium te markeren, de scorecard te versioneren als het beleid verandert, en verschillende scorecards op verschillende wachtrijen toe te passen. Liggen de criteria vast, dan ben je het volgende jaar bezig stakeholders uit te leggen waarom de kwaliteitsscore van de tool niet overeenkomt met die van jezelf.

Bewijs, niet alleen een getal

Vraag een score te zien en vraag daarna waarom. Elk criterium moet linken naar de specifieke regels die het activeerden. Zonder dat spoor kun je geen eerlijk bezwaarproces voeren, kun je niet kalibreren tegen menselijke reviewers, en accepteren medewerkers de scores niet. Dit is de betrouwbaarste voorspeller van of een implementatie haar eerste kwartaal overleeft.

Ga nog een stap verder en vraag de beoordelaar te bewijzen, niet alleen te lezen. Geef een paar honderd gesprekken die je reviewers al gescoord hebben, vraag de mate van overeenstemming daarmee, en besteed je tijd aan de verschillen. Een leverancier die die test verwelkomt, vertelt je iets. Een leverancier die antwoordt met een benchmarkcijfer gemeten op data die je niet kunt zien, vertelt je ook iets. Controleerbare nauwkeurigheid is in deze categorie zeldzamer dan zou moeten, en het is het criterium dat al het andere eerlijk houdt.

De weg van inzicht naar coaching

Vraag de leverancier om van een gevonden trend naar een afgeronde coachingsessie te gaan zonder het product te verlaten. Loopt de demo via een CSV-export, dan bestaat de workflow niet. Hoe die overdracht werkt, staat in QA-data omzetten in coaching (in het Engels), en het loont om te beslissen hoe je die cyclus wilt laten verlopen voordat je iemand een demo ziet geven.

Zo voer je een evaluatie uit die echt iets beslist

Demo’s zijn gebouwd om te slagen. De enige betrouwbare evaluatie is een gestructureerde pilot op je eigen gesprekken, en die duurt ongeveer drie weken.

Ontwerp de pilot voordat je met leveranciers praat

Kies een representatieve steekproef, idealiter 300 tot 500 gesprekken die je echte mix van kanalen, je drukste wachtrijen, je talen en een bewust gekozen handvol slechte interacties bevatten die je al met de hand beoordeeld hebt. Bevries die set. Elke leverancier krijgt dezelfde gesprekken, zodat de vergelijking zinvol is in plaats van anekdotisch.

Bepaal hoe een voldoende eruitziet

Schrijf de succescriteria eerst op. Redelijke criteria: overeenstemming met je menselijke reviewers op objectieve criteria boven een afgesproken drempel, al je bekende slechte gesprekken gemarkeerd, transcripties die leesbaar genoeg zijn om er als supervisor op te coachen, een benoemde vraag over je operatie die binnen tien minuten uit de tool beantwoord is, en een implementatie zonder tijd van engineering. Heb je de drempel niet vooraf bepaald, dan praat je elk resultaat goed.

Test de saaie dingen

Laad je echte scorecard, geen voorbeeld, en meet hoe lang dat duurt. Zoek naar iets waarvan je het antwoord al weet en controleer of de tool het vindt. Geef de tool een week aan twee supervisors zonder training en kijk of ze hem uit zichzelf gebruiken. Vraag hoe het systeem omgaat met een gesprek dat het niet met vertrouwen kan scoren, want een tool die stilletjes gokt is slechter dan een tool die zich onthoudt en het gesprek ter review markeert.

Stel de ongemakkelijke vragen aan leveranciers

  • Wordt onze data gebruikt om je modellen te trainen, en kunnen we ons afmelden zonder functies te verliezen?
  • Waar wordt data verwerkt, inclusief eventuele subverwerkers, en kun je een specifieke regio garanderen?
  • Wat gebeurt er op de dag dat we vertrekken: kunnen we scores, criteria en transcripties in een bruikbaar formaat exporteren?
  • Wie is verantwoordelijk voor de nauwkeurigheid, en hoe vaak wordt het model opnieuw getoetst aan een menselijke norm?
  • Wat zeiden je drie meest recent vertrokken klanten, en wat veranderde er daardoor?

Kaizo is een van de opties die het waard zijn om precies dit proces te doorlopen. Het beoordeelt AI-agents en je menselijke team op één norm, en elke score is terug te voeren op het bewijs in het ticket, zodat je kunt aantonen of hij klopt op gesprekken die je reviewers al beoordeeld hebben. Volledige dekking maakt die test zinvol in plaats van anekdotisch: het is conversation intelligence waarin kwaliteit voorop staat, native in Zendesk en Salesforce, die 100% van de gesprekken scoort tegen je eigen criteria. Houd het aan dezelfde pilotcriteria als al het andere op je shortlist.

Prijsmodellen en wat de kosten echt bepaalt

Gepubliceerde prijzen zijn in deze categorie zeldzaam en lijstprijzen zeggen weinig, dus begrijp het model in plaats van op zoek te gaan naar een getal. Drie structuren domineren.

Per gebruiker

Je betaalt per medewerker, per supervisor of per gebruiker met een licentie, maandelijks of jaarlijks. Het is voorspelbaar en makkelijk te budgetteren, en het is het gunstigste model als je gespreksvolume per medewerker hoog is. Let op het onderscheid tussen volledige gebruikers en gebruikers die alleen kunnen kijken, want de volle prijs betalen voor een manager die één keer per week een dashboard leest, vertekent de hele business case.

Per gespreksvolume

Je betaalt per gesprek, ticket of minuut geanalyseerde audio. Het schaalt met gebruik in plaats van met het aantal medewerkers, wat past bij teams met veel volume ten opzichte van hun bezetting, en het is gebruikelijk waar de eigen kosten van de leverancier vooral uit transcriptie en modelinferentie bestaan. Het risico is dat volledige dekking iets wordt wat je moet rantsoeneren. Maakt de prijs het pijnlijk om 100% van de gesprekken te analyseren, dan heb je opnieuw steekproeven gekocht, met extra stappen.

Platformfee plus gebruik

Een basisabonnement voor het platform met gemeten gebruik erbovenop. Het is de gebruikelijkste vorm bij enterprises en de vorm waarover het meest te onderhandelen valt, maar ze vraagt het nauwkeurigste leeswerk. Vraag welke meters er zijn, wat het tarief bij overschrijding is, en wat er gebeurt in een piekmaand.

Wat het bedrag beïnvloedt

  • Volume en mix van kanalen: telefonie kost meer om te verwerken dan tekst, en lange telefoongesprekken kosten meer dan korte chats.
  • Dekking: elk gesprek scoren kost meer dan steekproeven, en is meestal nog steeds goedkoper dan de reviewers die het vervangt.
  • Talen: elke extra taal kan implementatiekosten of kosten per taal meebrengen.
  • Bewaartermijn: hoe lang transcripties en opnames bewaard worden, en of archivering apart gefactureerd wordt.
  • Implementatie en diensten: vraag uitdrukkelijk of onboarding, het configureren van criteria en integratiewerk inbegrepen zijn of apart geoffreerd worden.
  • Vorm van het contract: meerjarige contracten en jaarlijkse vooruitbetaling leveren meestal korting op, en kosten je meestal flexibiliteit.

Maak de vergelijking als totale kosten over drie jaar, inclusief implementatie en interne tijd, niet als maandelijkse stickerprijs. En maak ook de andere kant van de balans op: teruggewonnen uren van reviewers, voorkomen escalaties, en de waarde van een structureel probleem dat je in week twee vindt in plaats van in maand vijf.

De koopfouten die teams een jaar kosten

  • Analyse kopen zonder coachingcyclus. Dashboards waar niemand iets mee doet zijn de meest voorkomende mislukking in deze categorie. Een inzicht moet bij een benoemde persoon landen, met een volgende stap eraan vast.
  • Evalueren op de data van de leverancier. Elk product ziet er nauwkeurig uit op gesprekken die gekozen zijn omdat het ze goed afhandelt. Jouw accenten en jouw jargon zijn de enige eerlijke test.
  • Een vaste scorecard accepteren. Kun je je eigen norm er niet in vastleggen, dan meet de tool de definitie van kwaliteit van iemand anders en zullen je stakeholders het cijfer nooit vertrouwen.
  • Sentiment als hoofdmetric behandelen. Sentiment is een nuttig signaal en een slecht doel. Wie koopt op basis van een sentimentgrafiek, heeft meestal de scoring niet getest.
  • De adoptie negeren. Een tool die buiten de helpdesk leeft waarin je team al werkt, wordt tijdens de pilot gebruikt en daarna links gelaten. Native wint van ernaast.
  • De beveiligingsreview overslaan tot juridische zaken erbij komt. Dataresidentie, bewaartermijnen en voorwaarden over het trainen van modellen hebben deals in een laat stadium doen sneuvelen. Breng ze in week één ter sprake.
  • Kopen voor de organisatie die je vandaag hebt. Vraag hoe het model geprijsd wordt en presteert bij het dubbele van je huidige volume, en met AI die een groeiend deel van de contacten afhandelt.

Implementatie en een realistische tijd tot waarde

De implementatie-inspanning verschilt in deze categorie een orde van grootte, en bijna al dat verschil komt uit de diepte van de integratie, niet uit de analyse zelf.

De realistische planning

Een tool die native koppelt met de helpdesk of het CRM dat je al gebruikt, draait doorgaans binnen enkele dagen: je autoriseert de koppeling, historische gesprekken synchroniseren en het scoren begint. Een platform waarvoor een datapipeline gebouwd moet worden, telefonie geïntegreerd en een aparte medewerkersdirectory bijgehouden, is een project van maanden en vraagt meestal tijd van engineering die je moet inplannen.

Rol het gefaseerd uit in plaats van alles tegelijk aan te zetten. Week één: koppel het systeem en laat het de historie indexeren, zodat je een nulmeting hebt in plaats van een leeg dashboard. Week twee en drie: laad je bestaande scorecard en kalibreer die: laat de geautomatiseerde scoring lopen op gesprekken die je reviewers al beoordeeld hebben en stel de criteria bij waar ze het oneens zijn, precies zoals beschreven in de kwaliteit van gesprekken op schaal meten (in het Engels). Vanaf week vier: zet volledige dekking (in het Engels) aan en start het coachingritme. Trends en het herkennen van onderwerpen worden nuttiger naarmate het systeem langer draait, dus zie maand drie als het moment waarop de analysekant zich terugbetaalt.

Hoe het er na negentig dagen goed uitziet

Elk gesprek gescoord in plaats van een steekproef van 2%. Een kwaliteitsscore die je leiding gelooft, omdat ze kan doorklikken naar het bewijs erachter. Minstens één structureel probleem gevonden en opgelost dat handmatige review gemist zou hebben. Supervisors die hun tijd aan coachen besteden in plaats van aan beoordelen. Ter referentie voor het plafond: bij UiPath automatiseerde Kaizo 100% van de kwaliteitscontrole, met 200% ROI en een stijging van de kwaliteitsscore met 8%.

Kan een leverancier niet in zulke concrete termen beschrijven hoe jouw uitkomst na negentig dagen eruitziet, dan is dat nuttige informatie. De beste evaluatievraag in deze hele categorie is gewoon: wat is er drie maanden na de livegang waar over mijn operatie, en hoe weet ik dat?

Veelgestelde vragen

Wat is conversation intelligence software?

Het is software die klantgesprekken over telefonie, chat, e-mail en messaging vastlegt, transcribeert en structureert, en ze daarna automatisch scoort en analyseert op kwaliteit, sentiment, intentie en nieuwe onderwerpen. Voor supportteams draait het om dekking: het beoordeelt 100% van de gesprekken tegen je norm in plaats van de kleine steekproef die een team van mensen met de hand kan lezen.

Wat is het verschil tussen conversation intelligence en speech analytics?

Speech analytics is de voorloper van de categorie die alleen telefonie doet: het transcribeert telefoongesprekken en doorzoekt ze op trefwoorden en zinsdelen. Conversation intelligence dekt elk kanaal, voegt het herkennen van intentie, onderwerpen en trends toe bovenop de transcriptie, en voegt in CX-producten geautomatiseerd scoren tegen criteria en een coachingworkflow toe. Doet een product alleen telefonie, dan is het speech analytics, wat de website er ook van zegt.

Wat kost conversation intelligence software?

Prijzen worden bijna altijd geoffreerd in plaats van gepubliceerd, en volgen een van drie modellen: per gebruiker, per gesprek of minuut geanalyseerd volume, of een platformfee plus gemeten gebruik. De belangrijkste kostenfactoren zijn het gespreksvolume, de verhouding tussen telefonie en tekst, het aantal talen, de bewaartermijn van data en of implementatie en configuratie inbegrepen zijn. Vergelijk de totale kosten over drie jaar inclusief interne tijd, niet de maandelijkse stickerprijs.

Wat moet ik testen tijdens een pilot met conversation intelligence?

Bevries een set van 300 tot 500 van je eigen gesprekken die je echte mix van kanalen, je talen en een paar bekende slechte interacties bevatten, en geef elke leverancier dezelfde set. Test de kwaliteit van de transcriptie door de transcripties zelf te lezen, laad je echte scorecard in plaats van een voorbeeld, en meet de overeenstemming met de scores die je reviewers al gaven. Bepaal de drempel voor een voldoende voordat je begint, anders praat je het resultaat goed.

Vervangt conversation intelligence software QA-analisten?

Nee, het verandert wat ze doen. De software neemt het mechanische beoordelen van duizenden gesprekken over, waardoor analisten tijd krijgen voor het werk dat alleen mensen kunnen doen: de norm kalibreren, bezwaren afhandelen, de structurele problemen onderzoeken die het systeem aan het licht brengt, en coachen. Teams die het puur als besparing op personeel zien, eindigen meestal met dashboards waar niemand iets mee doet.

Verwante begrippen

Test conversation intelligence op je eigen gesprekken

Neem je scorecard mee en een set gesprekken die je reviewers al beoordeeld hebben. We koppelen Kaizo aan je helpdesk, scoren ze allemaal tegen je criteria en laten je het bewijs achter elke score zien, zodat je het kunt beoordelen op dezelfde criteria die je op al het andere toepast.

Demo boeken Ontdek Agentic Auto QA Bekijk Kaizo Insights

Op deze pagina

Zie dit op je eigen gesprekken

We scoren een steekproef van je echte tickets op basis van jouw standaarden, zodat het voorbeeld van jou is.

Vertrouwd door internationale supportteams

  • Foot Locker
  • SteelSeries
  • Canva
  • GetYourGuide
  • Instacart