Conversation intelligence software scoort en analyseert 100% van de klantgesprekken over telefonie, chat, e-mail en messaging. Kies er een met een pilot op je eigen gesprekken, gescoord tegen je eigen criteria en vergeleken met wat je reviewers concludeerden.
In het kort
- Tools voor het opnemen van salesgesprekken dragen hetzelfde label, maar lossen een ander probleem op.
- Zwakke transcriptie van je eigen audio maakt elke latere score onbetrouwbaar.
- Sta op je eigen beoordelingscriteria, met bewijs gekoppeld aan elke score.
Wat conversation intelligence software doet, in één sectie
Conversation intelligence software luistert naar je klantgesprekken en leest ze, zet ze om in gestructureerde, doorzoekbare data en voert daar analyses op uit: scoren, sentiment, intentie, onderwerpen en trends herkennen, en waarschuwingen sturen. De volledige uitleg over hoe die onderliggende pipeline werkt staat in de gids over conversation intelligence (in het Engels), en de korte definitie in wat is conversation intelligence (in het Engels). Deze pagina gaat ervan uit dat je al weet wat het is en wilt beslissen welke je koopt.
Voor een koopbeslissing is belangrijk dat de categorie bovenop een aantal oudere, smallere categorieën ligt. Speech analytics (in het Engels) dekt de telefoniekant. Text analytics (in het Engels) dekt chat, e-mail en messaging. Interaction analytics (in het Engels) en conversation analytics (in het Engels) zijn naaste buren waarmee verschillende leveranciers een net iets andere reikwijdte bedoelen. Zegt een salesteam dat een product conversation intelligence doet, vraag dan welke van die lagen het zelf bouwt en voor welke het met een partner werkt. Het antwoord verandert de prijs, de nauwkeurigheid en de implementatie meer dan welke functie op een slide ook. Enterprisesuites zoals Verint en Cresta bundelen meerdere van die lagen.
Een handig kader: de software moet drie taken na elkaar uitvoeren, en een zwakte in de eerste taak vergiftigt de rest. Ze moet getrouw vastleggen en transcriberen, ze moet juist interpreteren wat er gebeurde, en ze moet die interpretatie bij een mens krijgen die ernaar kan handelen. De meeste teleurstellende implementaties falen bij taak één of taak drie, niet bij taak twee.
Conversation intelligence voor CX is geen opnamesoftware voor sales
Zoek op conversation intelligence software en ongeveer de helft van de resultaten zijn tools voor salesteams. Ze nemen uitgaande gesprekken op, labelen spreektijdverhoudingen en het omgaan met bezwaren, en voeden een omzetprognose. Voor die taak zijn het goede producten. Voor een supportorganisatie zijn ze de verkeerde aankoop, en die verwarring kost teams echt geld.
De verschillen die ertoe doen als je koopt
Salesgerichte tools zijn gebouwd voor telefonie, omdat salesgesprekken nu eenmaal telefoongesprekken zijn. Support meestal niet: tickets, chat, e-mail en messaging zijn doorgaans het grootste deel van het volume, dus een architectuur die op telefonie gebouwd is laat de meeste van je gesprekken ongeanalyseerd. Salestools zijn geoptimaliseerd om een klein team van waardevolle verkopers te coachen op een handvol gesprekken per week. Support heeft dekking nodig over honderden medewerkers en tienduizenden gesprekken, en dat is een heel ander schaalprobleem.
Het diepste verschil is de eenheid van beoordeling. Conversation intelligence voor sales vraagt of de verkoper de deal verder bracht. Conversation intelligence voor CX vraagt of het gesprek aan je kwaliteitsnorm voldeed: werd de klant geverifieerd, werd het beleid gevolgd, was de informatie juist, werd het probleem echt opgelost, was de toon goed. Dat betekent dat de CX-versie een echte scoring-engine moet hebben die gekoppeld is aan beoordelingscriteria die van je eigen bedrijf zijn, plus een proces voor bezwaren en kalibratie, omdat scores die aan mensen hangen eerlijk moeten zijn. Kan een product je geen configureerbare scorecard en geen spoor van bewijs laten zien, dan is het een salestool met een supportlabel erop.
De checklist van functies
Gebruik dit als scoreblad voor elke leverancier op je shortlist. De rechterkolom is de versie van de vraag die moeilijk met marketingtaal te beantwoorden is, dus stel hem in die vorm en noteer de specifieke details in plaats van de geruststellingen.
| Functie | Waarom het telt | Vraag aan de leverancier |
|---|---|---|
| Nauwkeurigheid van de transcriptie | Elke score, trend en zoekresultaat komt voort uit de transcriptie. Fouten stapelen zich ongemerkt op. | Wat is je word error rate op onze talen, accenten en audiokwaliteit, gemeten op onze opnames in plaats van op die van jou? |
| Scheiding van sprekers | Zonder betrouwbare diarisatie weet je niet wie wat zei, en is scoren per medewerker giswerk. | Hoe ga je om met door elkaar praten, doorverbindingen, gesprekken met drie partijen en een slechte lijn? |
| Dekking van kanalen | Het supportvolume is grotendeels tekst. Een tool die alleen telefonie doet, analyseert een minderheid van je gesprekken. | Welke kanalen worden native ondersteund, en is de analyse in alle kanalen gelijk of alleen voor telefonie gebouwd? |
| Zoeken in gesprekken | De dagelijkse waarde is een vraag in minuten beantwoorden in plaats van na een week handmatig lezen. | Kan ik tegelijk zoeken op zinsdeel, intentie, uitkomst en metadata, en hoe actueel is de index? |
| Scoren tegen je eigen criteria | Een vast template van de leverancier meet het idee van kwaliteit van de leverancier, niet dat van je bedrijf. | Kan ik mijn eigen scorecard bouwen, wegen en versioneren, en verschillende criteria gebruiken per wachtrij of regio? |
| Scores gekoppeld aan bewijs | Op een score die je niet kunt controleren, kun je niet coachen, kun je geen bezwaar maken, en medewerkers vertrouwen hem niet. | Laat me een score zien en klik meteen door naar de exacte regels in het gesprek die hem opleverden. |
| Aantoonbare nauwkeurigheid | Nauwkeurigheid die je niet op je eigen data kunt controleren, is een bewering en geen meting. | Kunnen we je scoring laten lopen op 200 gesprekken die onze reviewers al beoordeeld hebben, en de mate van overeenstemming en de verschillen zien? |
| Sentiment en intentie | Vertelt je waarom klanten contact opnemen en hoe het voelde, niet alleen hoeveel. | Hoe wordt sentiment bepaald, hoe wordt het gevalideerd, en kan ik eigen intenties voor mijn bedrijf definiëren? |
| Onderwerpen en trends herkennen | Brengt nieuwe problemen aan het licht voordat ze in CSAT of het ticketvolume zichtbaar worden. | Ontdekt het zelf nieuwe onderwerpen, of matcht het alleen met een lijst die ik bijhoud? |
| Coachingworkflow | Een inzicht dat geen medewerker bereikt, verandert niets. | Wat gebeurt er tussen een lage score en een coachingsgesprek, binnen het product, zonder exports? |
| Waarschuwingen | Sommige fouten vragen vandaag een reactie, niet pas in het maandrapport. | Wat kan een waarschuwing triggeren, waar komt die terecht, en hoe voorkom ik dat iedereen afstompt door te veel meldingen? |
| Integraties | Een apart systeem waar niemand inlogt, wordt binnen een kwartaal links gelaten. | Is dit native in onze helpdesk en CRM, of een export, een synchronisatietaak of een iframe? |
| Beveiliging en dataresidentie | Klantgesprekken zijn een van de gevoeligste soorten data die je hebt. | Waar wordt data opgeslagen en verwerkt, welke certificeringen heb je, wordt onze data gebruikt om modellen te trainen, en wat is het verwijderbeleid? |
De vier functies die kopers onderschatten
De meeste shortlists gaan op elkaar lijken, omdat elke leverancier elke rij hierboven claimt. In deze vier zitten de echte verschillen.
Kwaliteit van transcriptie en diarisatie op je eigen audio
Claims over nauwkeurigheid worden gemeten op schone, Engelstalige benchmarkaudio met één spreker. Jouw werkelijkheid is achtergrondgeluid, regionale accenten, anderstalige sprekers, productjargon en klanten die door medewerkers heen praten. Vraag een test op twintig van je eigen slechtste opnames en lees de transcripties zelf. Let vooral op productnamen, ordernummers en ontkenningen, want een weggevallen “niet” draait de betekenis van een zin om en tast zowel sentiment als compliancecontroles ongemerkt aan.
Scoren tegen criteria die jij beheert
Het verschil tussen analyse en kwaliteitsmanagement is of het systeem gesprekken beoordeelt tegen een norm die je eigen bedrijf heeft vastgelegd. Zoek naar de mogelijkheid om eigen criteria te schrijven, ze te wegen, sommige als knock-outcriterium te markeren, de scorecard te versioneren als het beleid verandert, en verschillende scorecards op verschillende wachtrijen toe te passen. Liggen de criteria vast, dan ben je het volgende jaar bezig stakeholders uit te leggen waarom de kwaliteitsscore van de tool niet overeenkomt met die van jezelf.
Bewijs, niet alleen een getal
Vraag een score te zien en vraag daarna waarom. Elk criterium moet linken naar de specifieke regels die het activeerden. Zonder dat spoor kun je geen eerlijk bezwaarproces voeren, kun je niet kalibreren tegen menselijke reviewers, en accepteren medewerkers de scores niet. Dit is de betrouwbaarste voorspeller van of een implementatie haar eerste kwartaal overleeft.
Ga nog een stap verder en vraag de beoordelaar te bewijzen, niet alleen te lezen. Geef een paar honderd gesprekken die je reviewers al gescoord hebben, vraag de mate van overeenstemming daarmee, en besteed je tijd aan de verschillen. Een leverancier die die test verwelkomt, vertelt je iets. Een leverancier die antwoordt met een benchmarkcijfer gemeten op data die je niet kunt zien, vertelt je ook iets. Controleerbare nauwkeurigheid is in deze categorie zeldzamer dan zou moeten, en het is het criterium dat al het andere eerlijk houdt.
De weg van inzicht naar coaching
Vraag de leverancier om van een gevonden trend naar een afgeronde coachingsessie te gaan zonder het product te verlaten. Loopt de demo via een CSV-export, dan bestaat de workflow niet. Hoe die overdracht werkt, staat in QA-data omzetten in coaching (in het Engels), en het loont om te beslissen hoe je die cyclus wilt laten verlopen voordat je iemand een demo ziet geven.
Zo voer je een evaluatie uit die echt iets beslist
Demo’s zijn gebouwd om te slagen. De enige betrouwbare evaluatie is een gestructureerde pilot op je eigen gesprekken, en die duurt ongeveer drie weken.
Ontwerp de pilot voordat je met leveranciers praat
Kies een representatieve steekproef, idealiter 300 tot 500 gesprekken die je echte mix van kanalen, je drukste wachtrijen, je talen en een bewust gekozen handvol slechte interacties bevatten die je al met de hand beoordeeld hebt. Bevries die set. Elke leverancier krijgt dezelfde gesprekken, zodat de vergelijking zinvol is in plaats van anekdotisch.
Bepaal hoe een voldoende eruitziet
Schrijf de succescriteria eerst op. Redelijke criteria: overeenstemming met je menselijke reviewers op objectieve criteria boven een afgesproken drempel, al je bekende slechte gesprekken gemarkeerd, transcripties die leesbaar genoeg zijn om er als supervisor op te coachen, een benoemde vraag over je operatie die binnen tien minuten uit de tool beantwoord is, en een implementatie zonder tijd van engineering. Heb je de drempel niet vooraf bepaald, dan praat je elk resultaat goed.
Test de saaie dingen
Laad je echte scorecard, geen voorbeeld, en meet hoe lang dat duurt. Zoek naar iets waarvan je het antwoord al weet en controleer of de tool het vindt. Geef de tool een week aan twee supervisors zonder training en kijk of ze hem uit zichzelf gebruiken. Vraag hoe het systeem omgaat met een gesprek dat het niet met vertrouwen kan scoren, want een tool die stilletjes gokt is slechter dan een tool die zich onthoudt en het gesprek ter review markeert.
Stel de ongemakkelijke vragen aan leveranciers
- Wordt onze data gebruikt om je modellen te trainen, en kunnen we ons afmelden zonder functies te verliezen?
- Waar wordt data verwerkt, inclusief eventuele subverwerkers, en kun je een specifieke regio garanderen?
- Wat gebeurt er op de dag dat we vertrekken: kunnen we scores, criteria en transcripties in een bruikbaar formaat exporteren?
- Wie is verantwoordelijk voor de nauwkeurigheid, en hoe vaak wordt het model opnieuw getoetst aan een menselijke norm?
- Wat zeiden je drie meest recent vertrokken klanten, en wat veranderde er daardoor?
Kaizo is een van de opties die het waard zijn om precies dit proces te doorlopen. Het beoordeelt AI-agents en je menselijke team op één norm, en elke score is terug te voeren op het bewijs in het ticket, zodat je kunt aantonen of hij klopt op gesprekken die je reviewers al beoordeeld hebben. Volledige dekking maakt die test zinvol in plaats van anekdotisch: het is conversation intelligence waarin kwaliteit voorop staat, native in Zendesk en Salesforce, die 100% van de gesprekken scoort tegen je eigen criteria. Houd het aan dezelfde pilotcriteria als al het andere op je shortlist.
Prijsmodellen en wat de kosten echt bepaalt
Gepubliceerde prijzen zijn in deze categorie zeldzaam en lijstprijzen zeggen weinig, dus begrijp het model in plaats van op zoek te gaan naar een getal. Drie structuren domineren.
Per gebruiker
Je betaalt per medewerker, per supervisor of per gebruiker met een licentie, maandelijks of jaarlijks. Het is voorspelbaar en makkelijk te budgetteren, en het is het gunstigste model als je gespreksvolume per medewerker hoog is. Let op het onderscheid tussen volledige gebruikers en gebruikers die alleen kunnen kijken, want de volle prijs betalen voor een manager die één keer per week een dashboard leest, vertekent de hele business case.
Per gespreksvolume
Je betaalt per gesprek, ticket of minuut geanalyseerde audio. Het schaalt met gebruik in plaats van met het aantal medewerkers, wat past bij teams met veel volume ten opzichte van hun bezetting, en het is gebruikelijk waar de eigen kosten van de leverancier vooral uit transcriptie en modelinferentie bestaan. Het risico is dat volledige dekking iets wordt wat je moet rantsoeneren. Maakt de prijs het pijnlijk om 100% van de gesprekken te analyseren, dan heb je opnieuw steekproeven gekocht, met extra stappen.
Platformfee plus gebruik
Een basisabonnement voor het platform met gemeten gebruik erbovenop. Het is de gebruikelijkste vorm bij enterprises en de vorm waarover het meest te onderhandelen valt, maar ze vraagt het nauwkeurigste leeswerk. Vraag welke meters er zijn, wat het tarief bij overschrijding is, en wat er gebeurt in een piekmaand.
Wat het bedrag beïnvloedt
- Volume en mix van kanalen: telefonie kost meer om te verwerken dan tekst, en lange telefoongesprekken kosten meer dan korte chats.
- Dekking: elk gesprek scoren kost meer dan steekproeven, en is meestal nog steeds goedkoper dan de reviewers die het vervangt.
- Talen: elke extra taal kan implementatiekosten of kosten per taal meebrengen.
- Bewaartermijn: hoe lang transcripties en opnames bewaard worden, en of archivering apart gefactureerd wordt.
- Implementatie en diensten: vraag uitdrukkelijk of onboarding, het configureren van criteria en integratiewerk inbegrepen zijn of apart geoffreerd worden.
- Vorm van het contract: meerjarige contracten en jaarlijkse vooruitbetaling leveren meestal korting op, en kosten je meestal flexibiliteit.
Maak de vergelijking als totale kosten over drie jaar, inclusief implementatie en interne tijd, niet als maandelijkse stickerprijs. En maak ook de andere kant van de balans op: teruggewonnen uren van reviewers, voorkomen escalaties, en de waarde van een structureel probleem dat je in week twee vindt in plaats van in maand vijf.
De koopfouten die teams een jaar kosten
- Analyse kopen zonder coachingcyclus. Dashboards waar niemand iets mee doet zijn de meest voorkomende mislukking in deze categorie. Een inzicht moet bij een benoemde persoon landen, met een volgende stap eraan vast.
- Evalueren op de data van de leverancier. Elk product ziet er nauwkeurig uit op gesprekken die gekozen zijn omdat het ze goed afhandelt. Jouw accenten en jouw jargon zijn de enige eerlijke test.
- Een vaste scorecard accepteren. Kun je je eigen norm er niet in vastleggen, dan meet de tool de definitie van kwaliteit van iemand anders en zullen je stakeholders het cijfer nooit vertrouwen.
- Sentiment als hoofdmetric behandelen. Sentiment is een nuttig signaal en een slecht doel. Wie koopt op basis van een sentimentgrafiek, heeft meestal de scoring niet getest.
- De adoptie negeren. Een tool die buiten de helpdesk leeft waarin je team al werkt, wordt tijdens de pilot gebruikt en daarna links gelaten. Native wint van ernaast.
- De beveiligingsreview overslaan tot juridische zaken erbij komt. Dataresidentie, bewaartermijnen en voorwaarden over het trainen van modellen hebben deals in een laat stadium doen sneuvelen. Breng ze in week één ter sprake.
- Kopen voor de organisatie die je vandaag hebt. Vraag hoe het model geprijsd wordt en presteert bij het dubbele van je huidige volume, en met AI die een groeiend deel van de contacten afhandelt.
Implementatie en een realistische tijd tot waarde
De implementatie-inspanning verschilt in deze categorie een orde van grootte, en bijna al dat verschil komt uit de diepte van de integratie, niet uit de analyse zelf.
De realistische planning
Een tool die native koppelt met de helpdesk of het CRM dat je al gebruikt, draait doorgaans binnen enkele dagen: je autoriseert de koppeling, historische gesprekken synchroniseren en het scoren begint. Een platform waarvoor een datapipeline gebouwd moet worden, telefonie geïntegreerd en een aparte medewerkersdirectory bijgehouden, is een project van maanden en vraagt meestal tijd van engineering die je moet inplannen.
Rol het gefaseerd uit in plaats van alles tegelijk aan te zetten. Week één: koppel het systeem en laat het de historie indexeren, zodat je een nulmeting hebt in plaats van een leeg dashboard. Week twee en drie: laad je bestaande scorecard en kalibreer die: laat de geautomatiseerde scoring lopen op gesprekken die je reviewers al beoordeeld hebben en stel de criteria bij waar ze het oneens zijn, precies zoals beschreven in de kwaliteit van gesprekken op schaal meten (in het Engels). Vanaf week vier: zet volledige dekking (in het Engels) aan en start het coachingritme. Trends en het herkennen van onderwerpen worden nuttiger naarmate het systeem langer draait, dus zie maand drie als het moment waarop de analysekant zich terugbetaalt.
Hoe het er na negentig dagen goed uitziet
Elk gesprek gescoord in plaats van een steekproef van 2%. Een kwaliteitsscore die je leiding gelooft, omdat ze kan doorklikken naar het bewijs erachter. Minstens één structureel probleem gevonden en opgelost dat handmatige review gemist zou hebben. Supervisors die hun tijd aan coachen besteden in plaats van aan beoordelen. Ter referentie voor het plafond: bij UiPath automatiseerde Kaizo 100% van de kwaliteitscontrole, met 200% ROI en een stijging van de kwaliteitsscore met 8%.
Kan een leverancier niet in zulke concrete termen beschrijven hoe jouw uitkomst na negentig dagen eruitziet, dan is dat nuttige informatie. De beste evaluatievraag in deze hele categorie is gewoon: wat is er drie maanden na de livegang waar over mijn operatie, en hoe weet ik dat?
Veelgestelde vragen
Wat is conversation intelligence software?
Het is software die klantgesprekken over telefonie, chat, e-mail en messaging vastlegt, transcribeert en structureert, en ze daarna automatisch scoort en analyseert op kwaliteit, sentiment, intentie en nieuwe onderwerpen. Voor supportteams draait het om dekking: het beoordeelt 100% van de gesprekken tegen je norm in plaats van de kleine steekproef die een team van mensen met de hand kan lezen.
Wat is het verschil tussen conversation intelligence en speech analytics?
Speech analytics is de voorloper van de categorie die alleen telefonie doet: het transcribeert telefoongesprekken en doorzoekt ze op trefwoorden en zinsdelen. Conversation intelligence dekt elk kanaal, voegt het herkennen van intentie, onderwerpen en trends toe bovenop de transcriptie, en voegt in CX-producten geautomatiseerd scoren tegen criteria en een coachingworkflow toe. Doet een product alleen telefonie, dan is het speech analytics, wat de website er ook van zegt.
Wat kost conversation intelligence software?
Prijzen worden bijna altijd geoffreerd in plaats van gepubliceerd, en volgen een van drie modellen: per gebruiker, per gesprek of minuut geanalyseerd volume, of een platformfee plus gemeten gebruik. De belangrijkste kostenfactoren zijn het gespreksvolume, de verhouding tussen telefonie en tekst, het aantal talen, de bewaartermijn van data en of implementatie en configuratie inbegrepen zijn. Vergelijk de totale kosten over drie jaar inclusief interne tijd, niet de maandelijkse stickerprijs.
Wat moet ik testen tijdens een pilot met conversation intelligence?
Bevries een set van 300 tot 500 van je eigen gesprekken die je echte mix van kanalen, je talen en een paar bekende slechte interacties bevatten, en geef elke leverancier dezelfde set. Test de kwaliteit van de transcriptie door de transcripties zelf te lezen, laad je echte scorecard in plaats van een voorbeeld, en meet de overeenstemming met de scores die je reviewers al gaven. Bepaal de drempel voor een voldoende voordat je begint, anders praat je het resultaat goed.
Vervangt conversation intelligence software QA-analisten?
Nee, het verandert wat ze doen. De software neemt het mechanische beoordelen van duizenden gesprekken over, waardoor analisten tijd krijgen voor het werk dat alleen mensen kunnen doen: de norm kalibreren, bezwaren afhandelen, de structurele problemen onderzoeken die het systeem aan het licht brengt, en coachen. Teams die het puur als besparing op personeel zien, eindigen meestal met dashboards waar niemand iets mee doet.
Verwante begrippen
- Conversation intelligence: de complete gids (in het Engels)
- Wat is conversation intelligence? (in het Engels)
- Wat is speech analytics? (in het Engels)
- Wat is text analytics? (in het Engels)
- Wat is interaction analytics? (in het Engels)
- Wat is real-time agent assist? (in het Engels)
Test conversation intelligence op je eigen gesprekken
Neem je scorecard mee en een set gesprekken die je reviewers al beoordeeld hebben. We koppelen Kaizo aan je helpdesk, scoren ze allemaal tegen je criteria en laten je het bewijs achter elke score zien, zodat je het kunt beoordelen op dezelfde criteria die je op al het andere toepast.