La calibración en call center (en inglés, QA calibration) consiste en que varios revisores evalúen la misma conversación y comparen sus resultados, para que todos apliquen la scorecard de la misma manera. Sin calibración, dos personas califican el mismo ticket de forma distinta y las notas dejan de ser justas. La calibración convierte esos desacuerdos en criterios más claros, de modo que una nota refleje la conversación y no al revisor que la abrió.
En resumen
- La calibración de calidad significa que varios revisores evalúan la misma conversación por separado y luego comparan y acuerdan la nota correcta.
- La calibración saca a la luz criterios vagos que los revisores leen de forma distinta, y esa es la señal para reescribirlos.
- Una sesión de calibración sigue cuatro pasos: elegir una muestra común, evaluarla a ciegas, comparar y debatir, y actualizar la scorecard.
- Las sesiones programadas restan a los revisores tiempo para el coaching, así que la frecuencia es una cuestión de equilibrio.
- La evaluación automatizada aplica un único estándar a cada conversación, por lo que hace falta menos calibración, aunque las personas siguen poniéndose de acuerdo sobre qué es un buen trabajo.
Qué significa la calibración de calidad en un equipo de atención al cliente
En un equipo de atención al cliente, la calibración de calidad es la comprobación periódica de que cada revisor evalúa una conversación igual, con la misma scorecard. Los revisores evalúan por su cuenta una muestra común, comparan resultados y resuelven cada desacuerdo por escrito, para que un agente reciba la misma nota y la misma retroalimentación, lo revise quien lo revise.
El término viene de la metrología: un instrumento está calibrado cuando marca el mismo valor que una referencia conocida. En el control de calidad, los instrumentos son sus revisores y la referencia es la lectura acordada de cada criterio de su scorecard de QA. El software de calibración de Kaizo se basa en la misma idea: misma conversación, misma nota.
Por qué importa la calibración en call center
La calibración importa porque las notas de calidad solo significan algo si son coherentes. Cuando un revisor marca una conversación como conforme y otro marca esa misma conversación como un fallo, los agentes pierden la confianza en el programa. El coaching se convierte entonces en una discusión sobre la nota en lugar de sobre la conducta, y los datos dejan de ser útiles.
La calibración protege esa confianza. Al comprobar que los revisores coinciden en las mismas conversaciones, mantiene la scorecard justa y defendible. También deja al descubierto criterios demasiado subjetivos para evaluarse de forma fiable, lo que indica que hay que reescribirlos en algo observable. Con el tiempo, la calibración cumple tres funciones prácticas:
- Hace visible la deriva de los revisores en lugar de dejarla oculta.
- Incorpora los casos límite a los criterios escritos, para que la decisión no dependa de la memoria de alguien.
- Forma a los nuevos revisores con un estándar acordado.
Cómo se realiza una sesión de calibración
Una sesión de calibración se realiza en cuatro pasos repetibles: elegir una muestra común de conversaciones, pedir a cada revisor que la evalúe de forma independiente con la scorecard, comparar las notas entre sí y debatir las diferencias, y por último reformular cualquier criterio que haya causado desacuerdo. El cambio en la rúbrica es el verdadero resultado de la sesión.
Un ciclo de calibración típico sigue estos pasos:
1. Elegir una muestra común
Seleccione una o varias conversaciones que cada revisor evaluará de forma independiente, sin ver los resultados de los demás.
2. Evaluar con la scorecard
Cada revisor evalúa la conversación con la misma scorecard de calidad que el equipo usa a diario.
3. Comparar y debatir
El equipo pone en común las notas, debate dónde difieren y acuerda la interpretación correcta.
4. Actualizar la scorecard
Cuando un criterio ha causado desacuerdo, se aclara o se reformula para que se evalúe igual la próxima vez.
Sobre la frecuencia, los participantes, la selección de la muestra y cómo medir el acuerdo entre revisores, consulte nuestra guía sobre cómo realizar sesiones de calibración de QA (en inglés).
Un ejemplo práctico de calibración
Este es un ejemplo ilustrativo de calibración. Cuatro revisores evalúan la misma conversación de chat con una línea de la scorecard que dice «El agente mostró empatía», en una escala del 1 al 4. Asignan 2, 4, 3 y 4. La dispersión es el hallazgo: lo que hay que corregir antes de la próxima sesión es el criterio, no los revisores.
En el debate se ve que dos revisores dieron el punto por una frase de disculpa, mientras que los otros dos buscaban si el agente había reconocido el problema concreto del cliente. Ninguna de las dos lecturas es incorrecta, pero la scorecard nunca dijo cuál cuenta. El equipo reescribe la línea en algo observable:
| Antes | Después |
|---|---|
| El agente mostró empatía (del 1 al 4) | El agente reconoció el problema concreto del cliente con sus propias palabras antes de pasar a la solución (sí o no) |
El criterio reescrito puede comprobarse en la transcripción, así que la próxima sesión debería mostrar menos dispersión en él. Eso es lo que deja una sesión de calibración útil: una rúbrica de calidad modificada, no solo una reunión.
Cómo la automatización reduce la necesidad de calibración
La automatización reduce la necesidad de calibración porque la incoherencia que la calibración corrige es humana: los revisores discrepan entre sí y consigo mismos con el paso del tiempo. Cuando las conversaciones se evalúan de forma automática, un mismo modelo aplica el mismo estándar a cada conversación, así que la deriva entre revisores desaparece en gran parte y la calibración pasa a centrarse en definir el propio estándar.
Kaizo evalúa automáticamente el 100% de las conversaciones con su scorecard, y cada nota está vinculada a la evidencia en la transcripción, de modo que los resultados se mantienen coherentes sin sesiones de calibración recurrentes. AutoPilot, la evaluación automatizada de Kaizo, interpreta la rúbrica de forma idéntica cada vez, por lo que no necesita calibración; la calibración es para los revisores humanos que trabajan a su lado. En UiPath, Kaizo automatizó el 100% del QA con un ROI del 200%, y la nota que recibe una conversación ya no depende del revisor que la abrió. En GAMING1, el equipo usó Kaizo para evaluar las conversaciones de forma coherente y seguir la tasa de evaluación de calidad como métrica en sí misma; esa tasa subió del 78% al 82% entre 2021 y 2022.
Véalo en sus propias conversaciones. Kaizo evalúa el 100% de sus conversaciones de atención al cliente y convierte los hallazgos en coaching. Reserve una demo.
La calibración sigue teniendo su lugar para definir qué es un buen trabajo, pero deja de ser un impuesto permanente sobre el tiempo de los revisores. Antes de confiar en las notas automatizadas, compárelas con las de sus revisores calibrados sobre la misma muestra, como se explica en nuestras guías sobre shadow scoring (en inglés) y sobre cómo crear un golden set (en inglés).
Cuándo las sesiones de calibración no son para usted
Las sesiones de calibración no son para usted cuando una sola persona revisa las conversaciones, porque no hay nadie con quien discrepar, o cuando todavía no tiene una scorecard escrita. En esos casos, escriba y pruebe primero la scorecard. La calibración alinea a las personas con un estándar; no puede crearlo de la nada.
Lo mismo vale para la evaluación automatizada. Si su equipo gestiona solo un puñado de conversaciones por semana y un único responsable las lee todas, basta con una hoja de cálculo y una scorecard clara, y una herramienta de QA automatizado como Kaizo probablemente sea más de lo que necesita.
Preguntas frecuentes
¿Qué diferencia hay entre calibración y evaluación de calidad?
La evaluación de calidad consiste en calificar una sola conversación con su scorecard. La calibración es la comprobación de segundo nivel que asegura que distintos revisores obtienen la misma nota en la misma conversación, para que la propia evaluación sea fiable.
¿Con qué frecuencia conviene calibrar?
La mayoría de los equipos con QA manual hacen sesiones de calibración semanales o mensuales, además de cada vez que cambia la scorecard o se incorpora un nuevo revisor. La frecuencia es una cuestión de equilibrio: más sesiones dan más coherencia, pero dejan menos tiempo para el coaching.
¿El QA automatizado sigue necesitando calibración?
Mucho menos. La evaluación automatizada aplica un estándar coherente a cada conversación, así que la deriva entre revisores desaparece. La calibración sigue siendo útil para acordar qué es un buen trabajo cuando diseña o revisa la scorecard por primera vez.
¿Qué provoca un bajo acuerdo en la calibración?
Normalmente, criterios vagos o subjetivos en la scorecard. Si una regla no puede vincularse a algo observable en la transcripción, los revisores la interpretarán de forma distinta, y esa es la señal para reescribir el criterio en uno claro y basado en evidencia.
¿Quién debe participar en la calibración?
Todas las personas que evalúan conversaciones, incluidos los líderes de equipo que revisan a sus propios agentes. Los nuevos revisores son los que más se benefician, porque la calibración los forma con el estándar que el resto del equipo ya acordó.
¿Qué debe producir una sesión de calibración?
Una sesión de calibración debe producir un cambio por escrito: un criterio reformulado, un caso límite aclarado o un ejemplo añadido a la scorecard. Si nada cambia en la scorecard, el mismo desacuerdo volverá en la próxima sesión.