Saltar al contenido

Buenas prácticas

Cómo evaluar las habilidades blandas en el QA

Convierta la empatía, el tono y la desescalada en criterios basados en evidencias, para que las habilidades blandas dejen de omitirse o evaluarse a ojo.

· 6 min de lectura

Revisado por Dominik Blattner, fundador de Kaizo

En esta página

Divida cada habilidad blanda en conductas observables, como reconocer la situación del cliente o evitar echar la culpa, y evalúelas con la transcripción. Así dos revisores, o una IA, llegan a la misma nota.

En resumen

  • Pregunte «¿fue empático el agente?» y cada revisor responderá algo distinto.
  • Evalúe lo que hizo el agente, no lo que sintió el revisor.
  • Calibre sobre todo los criterios de habilidades blandas, porque ahí es donde más se desvían los revisores.
  • Evaluadas con cobertura total, las habilidades blandas se convierten en momentos de coaching.

Por qué las habilidades blandas suelen evaluarse mal

La mayoría de las scorecards tratan las habilidades blandas de una de estas dos malas formas. O las omiten y evalúan solo la mecánica objetiva porque es fácil, lo que les dice en silencio a los agentes que cómo hicieron sentir al cliente no cuenta. O las incluyen como impresiones, con criterios como «¿fue empático el agente?» o «¿fue adecuado el tono?», que suenan razonables y son casi imposibles de evaluar, porque cada revisor responde desde su propia idea de cómo es la empatía.

El resultado es lo peor de ambos mundos. Los criterios que probablemente más importan para la experiencia del cliente son los que se evalúan con menos consistencia, y los agentes aprenden que su nota de habilidades blandas en realidad mide quién les revisó. Es el mismo problema de consistencia que la calibración existe para resolver, concentrado en los criterios donde más duele.

Descomponga la habilidad en conductas observables

El paso que hace evaluable una habilidad blanda es dejar de evaluar la abstracción y empezar a evaluar las conductas que la producen. La empatía no es un sentimiento que se detecta; es un conjunto de cosas que un agente hizo o no hizo, cada una visible en la transcripción.

Habilidad blandaVersión imposible de evaluarConductas observables que evaluar en su lugar
Empatía¿Fue empático el agente?Reconoció el problema concreto antes de resolverlo; nombró el impacto para el cliente; evitó el lenguaje que minimiza
Tono¿Fue adecuado el tono?Ajustó el grado de formalidad al cliente; evitó frases despectivas o robóticas; se adaptó cuando el cliente estaba molesto
Desescalada¿Desescaló el agente la situación?Reconoció la frustración de forma explícita; asumió la responsabilidad en lugar de desviarla; ofreció pronto un siguiente paso concreto
Escucha activa¿Escuchó el agente?Mencionó detalles que dio el cliente; no pidió información ya facilitada; confirmó que había entendido antes de actuar
Tranquilizar al cliente¿Quedó tranquilo el cliente?Fijó una expectativa concreta; explicó lo que pasará después; evitó promesas vagas

Redacte las conductas para que decida la evidencia

Una vez que tenga las conductas, formule cada una como algo que responde la transcripción y no como algo que juzga el revisor. «Reconoció el problema concreto del cliente antes de ofrecer una solución» se puede responder: puede señalar la línea, o su ausencia. «Fue cálido» no. Es la misma disciplina que redactar una rúbrica que una IA pueda evaluar, y tiene un efecto secundario útil: los criterios lo bastante claros para que los evalúe una IA son criterios lo bastante claros para que, por fin, sus revisores humanos también coincidan.

Tenga en cuenta dos advertencias. Primero, no lo concrete tanto que se convierta en un guion. La conducta es «reconoció la situación del cliente», no «dijo las palabras exactas “entiendo que esto es frustrante”», porque evaluar el guion produce el tono robótico que se trata en positive scripting. Evalúe si el agente hizo la cosa, con sus propias palabras. Segundo, tenga en cuenta el contexto: la empatía que necesita un restablecimiento rutinario de contraseña es distinta de la que necesita un error de facturación que le costó dinero al cliente, así que las mejores scorecards juzgan si la respuesta fue proporcionada a la situación.

Calibre aquí más que en ningún sitio y después evalúelo todo

Los criterios de habilidades blandas son donde más se desvían los revisores, así que son donde más rinde la calibración. Someta específicamente sus criterios de empatía y tono a la calibración: haga que los revisores evalúen las mismas conversaciones con carga emocional, detecte dónde divergen y afine las definiciones de las conductas hasta que coincidan. Si los revisores no se ponen de acuerdo, el criterio sigue siendo una impresión y no una conducta, y hay que reescribirlo.

Después, dos cosas hacen que evaluar las habilidades blandas sea realmente útil. La cobertura: evaluar todas las conversaciones en lugar de una muestra es lo que le permite ver si la empatía de un agente se mantiene en todo su abanico de conversaciones, no solo en las pocas que se seleccionaron. Y la trazabilidad: como cada nota de conducta señala la línea exacta, el coaching sobre algo tan delicado como la empatía puede partir de un momento real de una conversación real y no de la impresión general de un manager, y esa es la diferencia entre una retroalimentación que el agente acepta y una que le molesta. Evaluar bien el eje de la empatía es, en la práctica, donde muchos programas son más débiles y donde destaca un enfoque de QA pensado para ello.

Preguntas frecuentes

¿Cómo se evalúan habilidades blandas como la empatía en el QA?

Descomponiendo cada habilidad blanda en las conductas observables que la producen y evaluándolas con la transcripción. En lugar de preguntar si el agente fue empático, evalúa si reconoció el problema concreto del cliente, nombró su impacto y evitó el lenguaje que minimiza. Las conductas se pueden responder a partir de la evidencia, así que los revisores, y un evaluador de IA, pueden evaluarlas de forma consistente.

¿Por qué las habilidades blandas se evalúan de forma tan poco consistente?

Porque suelen redactarse como impresiones y no como conductas. Un criterio como «¿fue adecuado el tono?» pide a cada revisor que responda desde su propia idea de lo adecuado, así que las notas varían según quién revisó la conversación. Reescribir el criterio como conductas observables concretas elimina la mayor parte de esa desviación.

¿Puede una IA evaluar la empatía y el tono?

Sí, una vez que los criterios se basan en conductas y no en impresiones. Una IA puede comprobar si un agente reconoció la situación del cliente, mencionó los detalles que dio y evitó frases despectivas, porque eso es observable en la transcripción. No puede evaluar de forma fiable «¿fue empático el agente?» formulado como una abstracción, que es precisamente la versión que los revisores humanos también evalúan de forma poco consistente.

¿Cómo se evalúa la empatía sin que los agentes suenen a guion?

Evalúe la conducta, no las palabras exactas. El criterio es que el agente reconoció la situación del cliente, la formulara como la formulara, no que dijera una frase concreta. Evaluar un guion obligatorio produce el tono robótico que echa por tierra el objetivo. Juzgue si el agente hizo la cosa y permita que la respuesta sea proporcionada a la situación.

¿Por qué hay que calibrar sobre todo los criterios de habilidades blandas?

Porque es donde más se desvían los revisores. Haga que evalúen las mismas conversaciones con carga emocional, detecte dónde divergen y afine las definiciones de las conductas hasta que coincidan. Si aun así no se ponen de acuerdo, el criterio sigue siendo una impresión y hay que reescribirlo.

Términos relacionados

Haga que la empatía y el tono se puedan evaluar de verdad

Traiga sus criterios actuales de habilidades blandas y un conjunto de conversaciones con carga emocional. Le mostraremos cómo convertir la empatía y el tono en conductas que sus revisores y una IA puedan evaluar de la misma forma, en todas las conversaciones, con cada nota vinculada a la línea exacta para que el coaching parta de un momento real.

Reservar una demo Descubrir el QA de atención al cliente

En esta página

Véalo en sus propias conversaciones

Evaluaremos una muestra de sus tickets reales con sus propios estándares, para que el ejemplo sea el suyo.

La confianza de equipos de atención al cliente de todo el mundo

  • Foot Locker
  • SteelSeries
  • Canva
  • GetYourGuide
  • Instacart