Saltar al contenido

Guía

Qué es una rúbrica de calidad en call center

Una rúbrica de calidad en call center fija los criterios, niveles y pesos para evaluar conversaciones de atención al cliente. Con ejemplo para chat y email.

· 12 min de lectura

Revisado por Dominik Blattner, fundador de Kaizo

En esta página

Una rúbrica de calidad en call center (en inglés, QA rubric) es el conjunto de criterios que un equipo de atención al cliente usa para evaluar una conversación, con una descripción de cómo se ve cada nivel de calificación y cuánto pesa cada criterio. Convierte el «buen servicio» en líneas que dos revisores pueden evaluar igual, y es la lógica detrás de cada nota de calidad.

En resumen

  • Una rúbrica de calidad tiene cinco partes: criterios, una escala de calificación, descripciones de cada nivel, pesos y una lista corta de errores críticos.
  • Las descripciones de nivel son lo que la convierte en rúbrica y no en un checklist, porque le dicen al revisor qué significa realmente «cumple parcialmente».
  • La nota de calidad son los puntos obtenidos divididos entre los puntos posibles, y la forma de tratar el «no aplica» puede moverla diez puntos.
  • A la mayoría de los equipos de atención al cliente les va bien con 5 a 8 criterios que se puedan verificar solo con la transcripción.

Qué contiene una rúbrica de calidad de call center

Una rúbrica de calidad de call center tiene cinco partes: los criterios que se evalúan, la escala de calificación de cada uno, una descripción escrita de cada nivel de esa escala, un peso que fija cuánto cuenta cada criterio y unos pocos errores críticos que hacen fallar la conversación de inmediato. Si falta cualquiera de ellas, los revisores llenan el hueco con su criterio personal.

La palabra viene del mundo educativo. El centro de docencia de Carnegie Mellon define la rúbrica como «una herramienta de calificación que representa de forma explícita las expectativas de desempeño de una tarea» (en inglés) y señala que las rúbricas ayudan a mantener la coherencia entre evaluadores en cursos que tienen varios. Un equipo de atención al cliente con diez revisores tiene exactamente ese problema.

ParteQué respondeEjemplo
Criterio¿Qué estamos evaluando?«La respuesta fue correcta y completa»
Escala de calificación¿Cuántos resultados son posibles?Cumple, cumple parcialmente, no cumple, no aplica
Descripciones de nivel¿Cómo se ve cada resultado?«Cumple parcialmente: correcta, pero falta un detalle necesario»
Peso¿Cuánto cuenta?30 de 100 puntos
Error crítico¿Qué hace fallar toda la conversación?Datos de la cuenta compartidos antes de verificar la identidad

En muchos call centers, estos errores críticos se conocen como PEC (en inglés, auto-fail): un solo fallo deja la nota en cero, pase lo que pase en el resto. En un software, la rúbrica es el conjunto de criterios y descripciones que un software de scorecard para call center aplica a cada conversación.

Rúbrica, scorecard y checklist de calidad

Una rúbrica de calidad, una scorecard de QA y un checklist de QA describen la misma actividad con distinto nivel de detalle. La rúbrica es la lógica de calificación, la scorecard es el formulario que completa el revisor, y un checklist es una lista de puntos de sí o no, sin descripciones de nivel y normalmente sin pesos. Muchos equipos usan estas palabras como sinónimos.

Checklist de QAScorecard de QARúbrica de QA
Pregunta principal¿Ocurrió?¿Qué nota obtuvo?¿Qué significa cada nota?
CalificaciónSí o noSí o no, o una escalaEscala con una descripción por nivel
PesosRara vezNormalmenteNormalmente
Ideal paraPasos de proceso y de cumplimientoLa revisión del día a díaEl acuerdo entre revisores, las disputas, la automatización

En la práctica, su scorecard de QA es la rúbrica más el formulario que la rodea: el enlace a la conversación, el revisor, los comentarios y la nota final. Si su scorecard tiene criterios y pesos pero no una descripción escrita de cada nivel, tiene una scorecard a la que todavía le falta su rúbrica.

Un ejemplo de rúbrica de calidad para chat y email

Esta es una rúbrica de calidad completa para atención escrita por chat y email: seis criterios ponderados que suman 100 puntos, una escala de tres niveles con la descripción de cada uno y dos errores críticos. Es un ejemplo para adaptar, no un estándar. Cambie los criterios para que encajen con sus productos, sus políticas y sus motivos de contacto.

CriterioPesoCumple (puntos completos)Cumple parcialmente (mitad)No cumple (0)
Entendió el problema real15Reformula o actúa sobre el problema real, hace una pregunta aclaratoria cuando la solicitud es ambiguaResponde la pregunta literal pero no la necesidad de fondoResponde una pregunta distinta a la planteada
Respuesta correcta y completa30La información es exacta y cubre todo lo que el cliente necesita para actuarExacta, pero falta un detalle necesarioInformación errónea, desactualizada o engañosa
Siguió el proceso requerido20Cada paso requerido para este motivo de contacto está hecho (política de reembolsos, ruta de escalamiento, tipificación)Se omite un paso menor sin efecto para el clienteSe omite un paso requerido y el cliente se ve afectado
Siguiente paso y plazo claros15Dice qué pasa después, quién lo hace y para cuándoDa el siguiente paso, falta el plazoEl cliente tiene que adivinar qué pasará
Tono adecuado a la situación10Reconoce la frustración cuando existe, lenguaje sencillo, sin culparCortés pero genérico o de plantilla donde no debería serloDespectivo, culpabilizador o confuso
Notas suficientes para la siguiente persona10La nota interna o los campos del ticket permiten a un compañero seguir sin releer el hiloHay notas pero falta un dato claveSin notas en una conversación que necesita traspaso

Errores críticos (nota en cero): datos de la cuenta o personales compartidos antes de verificar la identidad; un reembolso o crédito prometido fuera de la política.

Dos cosas hacen de esto una rúbrica y no una lista. Cada nivel tiene una descripción que el revisor puede señalar en la transcripción, y las «notas» pueden marcarse como no aplica cuando no hace falta traspaso. Para versiones listas por canal, vea nuestras plantillas de scorecard de QA (en inglés).

Cómo se calcula la nota de calidad a partir de la rúbrica

Una nota de calidad son los puntos que obtuvo una conversación divididos entre los puntos que podía obtener, expresados en porcentaje. En la mayoría de las configuraciones, los criterios marcados como no aplica salen de ambos números, y un error crítico deja la nota en cero. El promedio de esas notas a lo largo de las conversaciones da la nota de calidad de un agente o de un equipo.

Tomemos un email evaluado con la rúbrica anterior:

CriterioPesoCalificaciónPuntos
Entendió el problema real15Cumple15
Respuesta correcta y completa30Cumple parcialmente15
Siguió el proceso requerido20Cumple20
Siguiente paso y plazo claros15No cumple0
Tono adecuado a la situación10Cumple10
Notas para la siguiente persona10No aplicase excluye

La conversación obtuvo 60 puntos de 90 posibles, así que la nota es 67%. Fíjese en lo que hace la regla del «no aplica». Si el equipo lo contara como fallo, la nota sería 60 de 100, es decir 60%. Si lo contara como cumplido, 70 de 100, es decir 70%. La misma conversación, diez puntos de diferencia, solo por una regla que nadie dejó por escrito.

Por eso la regla del no aplica tiene que estar dentro de la propia rúbrica. Los pesos importan igual: aquí un desliz de tono cuesta 5 puntos, mientras que una respuesta errónea cuesta hasta 30. Nuestra guía de ponderación de la scorecard muestra cómo fijar esas cifras con evidencia, y el artículo sobre el puntaje de calidad interno explica cómo las notas por conversación se agregan en una sola cifra de equipo.

Analítica u holística: cómo elegir el formato de la rúbrica

Hay dos formatos de rúbrica. Una rúbrica analítica evalúa cada criterio por separado y luego los combina, que es lo que hace casi toda rúbrica de QA en atención al cliente. Una rúbrica holística da una calificación global frente a una única descripción de la calidad. La analítica lleva más tiempo construirla, pero le dice al agente exactamente qué parte de la conversación debe corregir.

La oficina de evaluación de la Universidad de Oklahoma resume la disyuntiva: en una rúbrica analítica, «cada criterio puede ponderarse para reflejar la importancia relativa de cada dimensión» (en inglés), mientras que en una holística «los criterios no pueden ponderarse». La misma página señala que las rúbricas analíticas requieren más tiempo para desarrollarse y aplicarse.

Para los equipos de atención al cliente, la elección suele ser sencilla:

  • Use la analítica para el QA de agentes, el coaching y todo lo que esté ligado a un objetivo o a un bono. Los agentes necesitan saber qué criterio les costó puntos.
  • Use la holística para chequeos rápidos, como cuando un manager clasifica un lote de conversaciones en «bien, a mejorar, mal» para detectar un problema antes de construir una rúbrica completa.

Qué criterios de calidad deben estar en una rúbrica

Un criterio tiene lugar en una rúbrica de calidad cuando supera cuatro pruebas: el revisor puede verlo en la conversación, verifica una sola cosa, el agente lo controla y se aplica al tipo de contacto que se evalúa. Los criterios que no superan estas pruebas producen las notas que los agentes más disputan, porque dos revisores justos pueden llegar a veredictos distintos.

  1. Observable. «Mostró empatía» es una sensación. «Reconoció la frustración del cliente antes de responder» es algo que se puede citar.
  2. Una verificación por criterio. «Saludó al cliente y verificó su identidad» son dos criterios. Separe todo lo que esté unido por «y».
  3. Bajo el control del agente. Una herramienta lenta o una política que el agente no puede cambiar no debería costarle puntos. Regístrelo como un problema de proceso.
  4. Encaja con el motivo de contacto. Generar rapport tiene sentido en una queja y muy poco en un cambio de contraseña. En un hilo de Reddit sobre notas de QA, un agente de una comercializadora de energía se quejaba de que lo evaluaran por «acompañar al cliente en un recorrido» cuando el cliente solo quería hacer un pago.

En cuanto al número, la mayoría de los profesionales acaba en una lista corta. Un comentarista en un hilo de Reddit sobre rehacer el QA en una hoja de cálculo aconsejaba reducir la rúbrica a «5 a 7 criterios» y hacer que la mayoría fueran «verificables a partir del texto del ticket». Si piensa automatizar la evaluación, el listón es aún más alto; nuestra guía para escribir criterios que una IA pueda evaluar (en inglés) reescribe criterios vagos habituales en criterios verificables.

Cómo crear una rúbrica de calidad en seis pasos

Crear una rúbrica de calidad lleva seis pasos: elegir los resultados que debe proteger, listar los comportamientos que los producen, escribir cada uno como un criterio observable, describir cada nivel de calificación, fijar pesos y errores críticos, y probarla con varios revisores en conversaciones reales antes de que los agentes vean una sola nota.

  1. Empiece por los resultados. Anote las tres o cuatro cosas que una buena conversación debe lograr para su negocio: una respuesta correcta, un problema resuelto, un proceso conforme, un cliente que sabe qué pasa después.
  2. Liste los comportamientos que hay detrás. Lea entre 20 y 30 conversaciones recientes, buenas y malas, y anote qué hicieron los agentes que marcó la diferencia.
  3. Escriba los criterios. Convierta cada comportamiento en una afirmación única y observable usando las cuatro pruebas anteriores.
  4. Describa cada nivel. Para cada criterio, escriba cómo se ve cumple, cumple parcialmente y no cumple, con un ejemplo breve de una transcripción real.
  5. Fije pesos y errores críticos. Dé más puntos a lo que más daña a los clientes. Limite los errores críticos a los dos o tres fallos que de verdad no son negociables.
  6. Pruébela antes del despliegue. Pida a tres o cuatro revisores que evalúen las mismas diez conversaciones por separado y compare. Donde no coinciden, la descripción es poco clara, no el revisor.

El paso 6 es el que los equipos se saltan. En un hilo de Reddit sobre herramientas de scorecard de QA, un comentarista contaba que dos revisores evaluaron el mismo ticket con 60 y 85 porque «mostró empatía» significaba algo distinto para cada uno, y que los agentes «dejaron de confiar en la cifra». Una calibración regular evita que esa brecha se vuelva a abrir después del lanzamiento. Otro comentarista, en la misma pregunta publicada en un segundo subreddit, hizo otra observación práctica: los tickets de facturación, las escalaciones de bugs y las solicitudes de reembolso pueden necesitar rúbricas distintas, porque «no comparten criterios».

Aplicar una sola rúbrica a cada conversación

Una rúbrica solo rinde cuando se aplica igual a cada conversación, y ahí es donde la revisión manual se queda corta. Un revisor que lee una muestra pequeña no puede evaluar de forma coherente a gran volumen, y cada revisor se desvía un poco con el tiempo. La evaluación automatizada aplica un mismo estándar escrito a todas, sin nadie cansado ni con prisas.

Kaizo toma sus criterios existentes en lugar de imponerle una plantilla y evalúa el 100% de sus conversaciones de atención al cliente con ellos, ya haya respondido una persona o un agente de IA, con la evidencia vinculada a cada nota. Cuando cambia la descripción de un criterio, el cambio se aplica a cada evaluación futura, así que nadie tiene que volver a instruir a un equipo de revisores. En UiPath, Kaizo automatizó el 100% del QA con un ROI del 200%. En EverHelp (en inglés), la preparación del coaching se redujo un 75%.

Véalo en sus propias conversaciones. Kaizo evalúa el 100% de sus conversaciones de atención al cliente con su propia rúbrica y convierte los hallazgos en coaching. Reserve una demo o vea cómo funciona el software de scorecard para call center.

Cuándo una rúbrica formal no es para usted

Una rúbrica completa, ponderada y con descripciones de nivel no vale la pena para todos los equipos. Si una o dos personas atienden unas pocas docenas de tickets a la semana, un manager que lee las conversaciones y da retroalimentación directa cubre lo mismo con menos carga. Un checklist corto de sí o no basta hasta que empiezan a aparecer desacuerdos sobre la calidad.

Una rúbrica tampoco arregla un problema de proceso. Si todos los agentes fallan en el mismo criterio, la causa suele ser una política, una herramienta o la formación, y evaluar con más dureza solo hace que las notas se vean peor. Cree la rúbrica cuando tenga varios revisores, agentes que preguntan por qué perdieron puntos o un plan para evaluar las conversaciones de forma automática.

Preguntas frecuentes

¿Qué significa QA rubric?

QA rubric significa la guía de calificación que un equipo de control de calidad usa para evaluar conversaciones con clientes; en español, rúbrica de calidad. Enumera los criterios, la escala de calificación, cómo se ve cada nivel y cuánto cuenta cada criterio. «Quality assurance rubric» y «quality scorecard» son nombres comunes para lo mismo.

¿Qué es una nota de QA?

Una nota de QA es el resultado de aplicar la rúbrica a una conversación: puntos obtenidos divididos entre puntos posibles, en porcentaje. Los criterios marcados como no aplica suelen excluirse de ambos números, y un error crítico deja la nota en cero. Las notas de calidad de equipos y agentes son promedios de estas notas por conversación.

¿Cuántos criterios debe tener una rúbrica de calidad?

A la mayoría de los equipos de atención al cliente les va bien con 5 a 8 criterios, cada uno verificable en la transcripción. Con menos rara vez se cubren a la vez la exactitud, el proceso y la comunicación, y las listas mucho más largas son lentas de revisar y difíciles de evaluar de forma coherente. Los equipos con tipos de contacto muy distintos suelen mantener una rúbrica corta por tipo en lugar de una larga.

¿Una rúbrica de calidad debe usar una escala de sí o no o de 1 a 5?

Use sí o no para pasos que ocurrieron o no, como la verificación de identidad o un aviso obligatorio. Use una escala de tres niveles (cumple, cumple parcialmente, no cumple) para comportamientos con grados reales, como la completitud de la respuesta. Las escalas de cinco puntos solo valen la pena cuando cada punto tiene su propia descripción escrita.

¿Cada cuánto conviene actualizar una rúbrica de calidad?

Revise la rúbrica cuando cambien los productos, las políticas o los motivos de contacto, y al menos unas cuantas veces al año. Cambie un criterio cada vez y anote la fecha, porque cada cambio mueve las notas y hace más difícil comparar las tendencias de antes y después.

¿Se puede usar una rúbrica de calidad para agentes de IA?

Sí. La misma rúbrica puede evaluar conversaciones atendidas por un agente de IA y por personas, lo que mantiene la calidad comparable entre ambos. Los criterios tienen que ser observables en la transcripción, que de todos modos es una buena práctica para la revisión humana.

Términos relacionados

En esta página

Véalo en sus propias conversaciones

Evaluaremos una muestra de sus tickets reales con sus propios estándares, para que el ejemplo sea el suyo.

La confianza de equipos de atención al cliente de todo el mundo

  • Foot Locker
  • SteelSeries
  • Canva
  • GetYourGuide
  • Instacart