Aller au contenu

QA des agents IA

Votre agent IA répond aux clients. Kaizo vérifie chaque réponse.

Kaizo évalue 100 % des conversations de vos agents IA avec votre propre grille d’évaluation, celle-là même qui sert à évaluer votre équipe, et relie chaque note à la preuve dans la conversation. Gardez un fonctionnement entièrement automatisé, ou ajoutez une revue humaine exactement là où elle compte.

Opérationnel en quelques jours · Applications natives Zendesk et Salesforce

QA des agents IA
AutoPilot évalue une conversation de support résolue avec une grille d’évaluation personnalisée

Adopté par des équipes support du monde entier

5/5 sur G2
  • Sceau AICPA SOC 2 SOC 2 Type II
  • Marque ISO 27001 ISO 27001
  • Étoiles RGPD GDPR
Trust Center

Une résolution automatisée n’est pas une note de qualité

Votre helpdesk compte une conversation comme résolue quand le client n’a pas atteint un humain. Cela ne dit pas si la réponse était juste. Un agent IA peut inventer une politique, déclarer à tort un problème résolu ou garder un cas qu’il aurait dû transmettre, et chaque tableau de bord le compte quand même comme un succès. Comme il répond chaque fois à partir du même prompt et des mêmes contenus, la même erreur se répète dans toutes les conversations qu’il touche, et un échantillon de 2 % passe le plus souvent à côté.

Comment ça marche

Un seul standard pour les agents humains et IA

Kaizo fonctionne dans le helpdesk où se trouvent déjà les conversations de votre agent IA, et les évalue comme il évalue celles de votre équipe.

Votre grille

La même grille, avec des contrôles pensés pour un bot.

Évaluez les conversations des agents IA avec la même grille que celles de votre équipe, pour voir côte à côte les performances des agents humains et IA. Ajoutez ensuite les critères sur lesquels un bot échoue : exactitude des faits, fidélité aux politiques, périmètre et escalade. Rédigez-les avec vos propres mots et connectez votre base de connaissances, pour que l’IA juge par rapport à vos contenus.

  • Des critères avec vos propres mots, pas un modèle
  • Des critères communs gardent les résultats humains et IA comparables
  • Des contrôles en plus pour les faits inventés et les politiques inventées
Comment fonctionnent les grilles
Votre grille
Une grille d’évaluation QA Kaizo avec AutoPilot activé à 100 % de couverture cible

Chaque conversation

Chaque conversation de l’agent IA évaluée, avec la preuve.

AutoPilot évalue chaque conversation dès sa résolution et y joint un commentaire qui explique la note. Chaque note renvoie à la preuve dans la conversation : une erreur devient un exemple précis à présenter au responsable du prompt ou de l’article du centre d’aide.

  • 100 % des conversations, pas un échantillon
  • Chaque note expliquée et liée aux lignes qui la justifient
  • Vous choisissez les files, canaux ou équipes évalués
En savoir plus sur AutoPilot
Chaque conversation
Les notes d’AutoPilot sur une conversation de support, avec la raison de chaque critère non respecté

Suivi et analytique

Voir où l’agent IA échoue, et pourquoi.

Quand chaque conversation est évaluée, une erreur récurrente n’est plus une anecdote mais une tendance que vous suivez par équipe et par semaine. L’analyse des causes racines regroupe les erreurs derrière une baisse : dix mauvaises réponses issues d’un même article deviennent une seule correction. Réévaluez après chaque changement pour confirmer que la correction tient.

En savoir plus sur l’analyse des causes racines
Suivi et analytique
Vue d’ensemble QA de Kaizo avec les notes de qualité par équipe et par semaine

Revue humaine

Les humains restent dans la boucle.

Testez l’évaluation sur vos notes historiques avant la mise en production, et ajustez les critères jusqu’à ce qu’elle corresponde à votre équipe. Les évaluateurs gardent les conversations qui demandent du jugement : Auto QA pré-remplit les critères et rédige le feedback, qu’ils modifient et valident.

En savoir plus sur Auto QA
Revue humaine
Auto QA pré-remplit les critères d’évaluation pour un évaluateur humain
100%
de la QA automatisée chez UiPath
200%
de ROI sur l’automatisation de la QA chez UiPath
75%
de préparation du coaching en moins chez EverHelp

Quand Kaizo n’est pas le bon outil

Kaizo évalue les conversations une fois terminées, dans le helpdesk où elles se trouvent. Si vous avez besoin d’une suite de tests pour développeurs avant le lancement, comme des tests de régression des prompts dans votre pipeline CI, c’est une autre étape et un autre type d’outil, qui peut fonctionner aux côtés de Kaizo. Et si votre agent IA traite quelques dizaines de conversations par semaine, lisez-les vous-même : une heure par semaine avec les transcriptions et une courte checklist trouveront la plupart des problèmes.

Nouveau sur le sujet ? Lisez notre guide de la QA des agents IA, pourquoi le taux de containment n’est pas une note de qualité, quels indicateurs de l’IA au service client suivre (guides en anglais), ou consultez nos tarifs.

Vous testez un agent vocal ?

Tester un agent vocal avant son lancement, avec des appels de test scénarisés, relève des tests avant lancement : une autre étape que la QA des conversations réelles. Parlez-nous de votre configuration et nous vous dirons franchement si cela convient.

Des équipes support qui ont arrêté l’échantillonnage

  • 50%

    de temps QA en moins

    “Our tickets can be long and complex. AI has been a life-saver in our experience.”

    SteelSeries

  • 75%

    résolution plus rapide

    “Kaizo is an essential part of finding the root causes of areas we need to improve, then improving on that.”

    Foot Locker

FAQ

Questions fréquentes

Qu’est-ce que la QA des agents IA ?

La QA des agents IA consiste à évaluer les conversations traitées par votre chatbot ou votre agent IA selon un standard écrit, pour savoir si ses réponses étaient justes et autorisées, et pas seulement si le client a atteint un humain. Kaizo le fait sur chaque conversation, et chaque note renvoie à la preuve.

Kaizo peut-il évaluer les agents IA d’autres éditeurs ?

Oui. Si la conversation se trouve dans Zendesk ou Salesforce, Kaizo l’évalue avec la même grille que celles de votre équipe, quel que soit le concepteur de l’agent. Dans Zendesk, cela inclut les conversations traitées par les agents IA de Zendesk.

L’agent IA a-t-il la même grille que nos conseillers ?

Il peut partager les critères qui valent pour les deux, comme une réponse juste et le bon ton, ce qui garde les résultats comparables. Ajoutez ensuite les critères sur lesquels un bot échoue : ancrage dans vos propres contenus, limites des politiques, périmètre et escalade.

Kaizo peut-il vérifier le transfert de l’agent IA vers un humain ?

Oui, sous forme de critères dans votre grille : l’agent IA a-t-il escaladé au bon déclencheur, a-t-il transmis le contexte, et le conseiller l’a-t-il repris ? Vous voyez le transfert dans la conversation même à laquelle la note renvoie.

Un taux de containment élevé signifie-t-il que l’agent IA fonctionne ?

Pas à lui seul. Le containment compte une conversation comme un succès quand le client n’a pas atteint un humain, et une fausse résolution ou un cas que l’agent aurait dû transmettre ressemble exactement à cela. Il faut évaluer ce que l’agent a dit pour savoir si une conversation contenue était une bonne conversation.

Qui vérifie les notes ?

Votre équipe, partout où cela compte. Vous testez l’évaluation sur vos notes passées avant la mise en production, chaque note renvoie à la preuve pour que chacun puisse la vérifier, et Auto QA rédige un feedback qu’un évaluateur modifie et valide.

Devons-nous changer de helpdesk ?

Non. Kaizo s’intègre nativement à Zendesk et Salesforce Service Cloud et lit les conversations directement depuis ces outils. La mise en place prend quelques jours, pas un projet de connecteur.

Kaizo vend-il aussi des agents IA ?

Oui. La Kaizo Agentic Customer Service Platform apporte des agents IA spécialisés par rôle pour le travail qui sous-tend la qualité du support. Elle fait l’objet d’un pilote au T4 2026, et le travail des agents est mesuré au même standard que celui de vos équipes. La Plateforme de contrôle qualité qui évalue les conversations des agents IA est disponible dès maintenant.

Voyez-le sur les conversations de votre agent IA

Nous évaluons un échantillon de vos vraies conversations d’agent IA selon vos critères et vous montrons ce que le tableau de bord a compté comme un succès.

Adopté par des équipes support du monde entier

  • Foot Locker
  • SteelSeries
  • Canva
  • GetYourGuide
  • Instacart