Saltar al contenido

Buenas prácticas

Escalamiento de llamadas y tickets: cómo evaluarlo

Escalamiento de llamadas y tickets: qué evaluar en un caso escalado, cómo calificar la transferencia y cómo atribuir cada fallo con justicia al agente correcto.

· 18 min de lectura

Revisado por Dominik Blattner, fundador de Kaizo

En esta página

La calidad en el escalamiento de llamadas, chats y tickets mide qué tan bien se gestiona una conversación después de que sale de manos de su primer responsable. Evalúela con su propia rúbrica y atribuya cada fallo al punto en el que se originó.

En resumen

  • El tiempo de gestión, la adherencia al guion y el CSAT en bruto engañan en un escalamiento.
  • La transferencia es un evento evaluable con dos responsables.
  • El verdadero ahorro llega al preguntarse si el escalamiento debió existir.
  • Los escalamientos son demasiado escasos para que una muestra pequeña revele el patrón.

Qué cuenta como escalamiento de llamadas o tickets, y por qué su definición decide sus datos

Antes de evaluar escalamientos hay que acordar qué es uno, y la mayoría de los equipos de atención al cliente manejan en silencio tres definiciones incompatibles a la vez. El cliente pide hablar con un supervisor. Un agente reasigna un ticket a una cola especializada. Una regla se activa porque un nivel de servicio estaba a punto de incumplirse. Las tres se llaman escalamiento, no tienen nada en común en lo operativo, y promediarlas produce un número con el que nadie puede actuar.

Elija una definición, póngala por escrito y asegúrese de que quede registrada en el ticket, en lugar de deducirla después a partir de una etiqueta que alguien añadió de memoria. La prueba útil es la propiedad del caso: un escalamiento es cualquier conversación cuya propiedad cambia porque el responsable actual no puede resolverla con su autoridad, su información o sus habilidades. Eso excluye una reasignación rutinaria por capacidad e incluye el caso en el que nadie movió el ticket, pero un supervisor tuvo que autorizar el resultado.

El tipo importa porque decide a quién le pertenece la pregunta de calidad.

TipoQué lo activaA quién le pertenece la calidadQué le dice un pico
JerárquicoEl cliente o el agente involucra a un supervisor o un managerCompartida: el agente de origen y el supervisorA los agentes les falta autoridad, o confianza en la autoridad que tienen
FuncionalEl caso necesita un equipo especializado: facturación, ingeniería, confianza y seguridadEl equipo que recibe, más quien redactó la transferenciaEl alcance del primer nivel es demasiado estrecho, o las reglas de enrutamiento están mal
Prioridad o nivel de servicioUna regla se activa por antigüedad, riesgo de incumplimiento o nivel de cuentaLa cola y el modelo de plantilla, no una personaUn problema de capacidad o de acumulación disfrazado de escalamiento
Exigido por el clienteEl cliente pide explícitamente hablar con otra personaEl contacto de origen, casi siempreLa confianza se rompió en el primer intercambio. Revise ese intercambio, no el escalamiento
ExternoSale de la empresa: un regulador, una reseña pública, una amenaza legalEl programa, y debería activar una revisión formalAlgo superó antes varios controles internos

Por qué su scorecard habitual falla en un ticket escalado

La mayoría de los equipos evalúan los escalamientos con la scorecard que ya tienen, precisamente porque es la que ya tienen. Produce números, así que nadie nota que varios criterios han dejado de medir algo.

El problema no es que los escalamientos sean más difíciles. Es que los criterios estándar se diseñaron sobre supuestos que un escalamiento rompe: que el agente trata con el cliente por primera vez, que el cliente está en una posición neutral, que la resolución más rápida es la mejor y que existe una buena respuesta dentro del manual estándar. En un ticket escalado, ninguno se cumple. Antes de cambiar nada, conviene tener claro qué pretende medir realmente su scorecard de calidad.

Criterio por criterio, esto es lo que se rompe.

CriterioQué mide en un ticket rutinarioPor qué se rompe en un escalamientoQué usar en su lugar
Tiempo de gestión o de resoluciónEficienciaEl trabajo es deliberadamente más lento. El escalamiento existe porque la vía rápida falló, y premiar la velocidad aquí es premiar que se despache al clienteTiempo hasta la primera actualización relevante, y si se cumplieron los plazos prometidos
Adherencia a plantilla, macro o guionConsistenciaLa respuesta estándar es la que el cliente ya rechazó. Reutilizarla se percibe como un muroSi la respuesta abordó la objeción concreta que planteó el cliente
Apertura y saludoProfesionalismoEl cliente ya contó la historia una vez. Un saludo nuevo que ignora ese historial es la queja, no la cortesíaReconocimiento del contexto: si la respuesta demostró que se había leído el historial
Nota de satisfacción del ticketResultado para el clienteEl cliente llegó molesto. La nota califica en parte el contacto anterior, así que el agente hereda la valoración de otra personaEvolución del sentimiento a lo largo de la conversación escalada, más el recontacto en 14 días
Resolución en el primer contactoEfectividadPor definición no es un primer contacto, así que el criterio se incumple siempre o se excluye en silencioResolución duradera: si el mismo problema volvió
Exactitud de conocimiento o de políticasCorrecciónEste sobrevive intacto y aquí importa más que en ningún otro lugarManténgalo, y dele más peso que en el trabajo rutinario

Qué evaluar en su lugar en una conversación escalada

Seis criterios concentran casi toda la señal en un ticket escalado. Cada uno necesita evidencia que un segundo revisor pueda señalar en la transcripción; si no, habrá escrito adjetivos en lugar de una rúbrica.

  1. Absorción del contexto. ¿Leyó la persona que gestiona el caso el hilo antes de responder? La evidencia es concreta: hizo referencia a algo que el cliente dijo antes sin que tuviera que repetirlo. La evidencia del fallo es aún más fácil de detectar, y es el siguiente punto.
  2. La pregunta repetida. ¿Pidió la persona que gestiona el caso información que ya estaba en el hilo? Número de pedido, correo electrónico de la cuenta, qué salió mal. Es binario, a un revisor le lleva diez segundos y los agentes nunca lo discuten, porque la transcripción lo zanja.
  3. Reconocimiento sin culpar a otros. El cliente necesita que se nombre el fallo. Lo que incumple este criterio no es la falta de una disculpa, sino la evasión: culpar al agente anterior, al sistema, a la política o al cliente. Señalar a un compañero como causa delante de un cliente debería ser un error crítico.
  4. Exactitud de los compromisos. ¿Prometió la persona que gestiona el caso algo que la empresa realmente hará, en una fecha en la que realmente ocurrirá? Es el criterio que produce el siguiente escalamiento cuando falla, así que merece mucho peso.
  5. Uso de la autoridad por la que se escaló. Un escalamiento que termina con la misma respuesta, entregada por alguien de mayor rango, le ha costado dos agentes y no le ha dado nada al cliente. O la persona que gestiona el caso usó un margen de decisión que el primer agente no tenía, o la vía de escalamiento es decorativa.
  6. Cierre del ciclo. ¿Se informó al cliente del resultado, y se informó al agente de origen de cuál fue la resolución? La segunda mitad se omite casi en todas partes, y omitirla garantiza que el mismo agente cree el mismo escalamiento la semana siguiente.

Calibre antes de implementarlo

Los escalamientos son justamente las conversaciones en las que los revisores discrepan, porque tienen carga emocional y porque la respuesta correcta suele depender de un contexto que la transcripción solo contiene a medias. Haga una sesión de calibración con tres tickets escalados antes de poner en marcha la rúbrica. Si sus revisores no logran ponerse de acuerdo sobre si la persona que gestionó el caso usó un margen de decisión real, los agentes desde luego no aceptarán la nota. El formato es el mismo que el de cualquier otra sesión de calibración que realice (en inglés), con escalamientos como única muestra.

Evalúe la transferencia, no solo la resolución

Pregunte a un equipo de atención al cliente dónde fallan los escalamientos y le describirá la resolución. Lea cien hilos escalados y descubrirá que el daño suele producirse en los noventa segundos de la transferencia. El argumento de la Harvard Business Review a favor de reducir el esfuerzo del cliente en lugar de intentar deslumbrarlo se aplica aquí con especial fuerza, porque un escalamiento ya es un segundo intento y una transferencia descuidada lo convierte en un tercero.

La transferencia es un evento evaluable por sí mismo, y tiene dos responsables. Evalúela como un bloque propio, atribuyendo el lado que envía al agente de origen y el lado que recibe a la persona que gestiona el caso. Mantenerlos separados es lo esencial, porque es la única forma de que la nota recaiga en la persona correcta.

Lado que envía

  • El motivo del escalamiento queda registrado en el ticket, con palabras, no solo como etiqueta.
  • Lo que ya se intentó está resumido, para que quien recibe no lo repita.
  • Se informó al cliente de que se producía la transferencia, por qué y aproximadamente cuándo esperar una respuesta. Una transferencia silenciosa es un fallo aunque la resolución sea perfecta.
  • No se prometió nada en nombre del equipo que recibe que ese equipo no haya aceptado.

Lado que recibe

  • Se leyó el hilo antes de enviar la primera respuesta. La prueba de la pregunta repetida lo zanja.
  • Se reconoció la espera. El cliente ya ha esperado en una cola dos veces.
  • No se pidió al cliente que volviera a explicar el problema como forma de abrir la conversación.
  • Si el ticket se devolvió o se volvió a transferir, el motivo quedó registrado con el mismo rigor que en la primera transferencia.

De evaluar así la transferencia salen directamente dos indicadores, y ambos son más útiles que la tasa de escalamiento por sí sola. La tasa de pregunta repetida es la proporción de conversaciones escaladas en las que quien recibe pidió información que ya estaba en el hilo. La tasa de rebote es la proporción de escalamientos que se devuelven o se vuelven a transferir antes de resolverse, lo que suele ser un defecto de enrutamiento más que un fallo de una persona. Ninguno requiere una encuesta, y ambos se pueden contar a partir del registro de conversaciones que ya tiene. Si está construyendo un conjunto de indicadores más amplio, esto se suma a las demás formas de medir la calidad de las conversaciones (en inglés).

El problema de la atribución: ¿quién causó realmente este escalamiento?

Esta es la pregunta de equidad que decide si puede gestionar un programa de QA en el que los agentes confíen (en inglés), y casi ninguna guía sobre escalamientos la aborda.

La mayoría de los escalamientos se crean antes. Cuando una conversación llega a un especialista o a un supervisor, la decisión que la causó ya se tomó: un primer contacto que pasó algo por alto, una política que nadie en primer nivel puede flexibilizar, un fallo de producto o de sistema, o una expectativa que creó otra persona. Evaluar a quien gestiona el escalamiento por la existencia misma del escalamiento es la injusticia más común del QA en atención al cliente, y los agentes la detectan de inmediato.

La solución es una regla y un hábito.

La regla. A quien gestiona el escalamiento se le evalúa solo por el escalamiento. Si el escalamiento debió ocurrir es un hallazgo aparte, atribuido a un responsable aparte y registrado en un registro aparte. Nunca deje que una sola nota cargue con ambos juicios, porque en cuanto lo hace, las personas que se ocupan de su trabajo más difícil obtienen las peores notas.

El hábito. Cada revisión de un escalamiento son dos revisiones. Abra la conversación escalada y abra el contacto que la creó. Después clasifique el origen en una de cuatro categorías:

  • Gestión. El primer agente tenía la información y la autoridad y no las usó. Esto corresponde a una persona y se puede trabajar con coaching.
  • Política. El agente hizo exactamente lo que decía la política y la política produjo un cliente enfadado. Esto corresponde a quien es dueño de la política, y hacer coaching al agente por ello es peor que inútil.
  • Sistema o producto. Algo estaba roto, lento o mal. Esto va a un backlog de ingeniería o de operaciones, no a una reunión individual.
  • Expectativa. Una promesa hecha en otro lugar, por precios, marketing, un ticket anterior o un aviso de incidencia, no sobrevivió al contacto con la realidad.

Dos salvaguardas mantienen honesta la clasificación. La categoría de origen no debe fijarla quien gestiona el escalamiento, que tiene un interés evidente en ella, ni tampoco el agente de origen. Es decisión de un revisor. Y cuando la categoría de origen es política, sistema o expectativa, no cambia ninguna nota a nivel de agente, que es lo que debería decir en voz alta en el lanzamiento. Cuando las clasificaciones se acumulan, son la base de un verdadero análisis de causa raíz en lugar de una suposición mensual.

¿Debió ocurrir este escalamiento?

Merece la pena mejorar la calidad de la gestión. Reducir el volumen de escalamientos merece más, porque gestionar bien un escalamiento que se evita no cuesta nada, y porque cada escalamiento evitable es una dosis de insatisfacción del cliente que usted mismo ha fabricado.

Así que añada un veredicto a cada revisión de escalamiento, separado de la nota. Tres opciones, y la redacción importa, porque todo el objetivo es hacer visible la categoría del medio.

  • Evitable. El primer agente tenía la autoridad, la información y las herramientas para resolverlo. Nada estructural se lo impedía. Es un hallazgo de coaching, y en un programa sano debería ser una parte pequeña del total.
  • Estructural. Nadie en primer nivel podría haberlo resuelto, por un permiso que no tiene, un sistema al que no tiene acceso o una política que no puede flexibilizar. Esta es la categoría importante. No es un problema del agente, es un problema de diseño, y cada ticket que contiene es candidato a bajar la autoridad un nivel.
  • Legítimo. El escalamiento es el proceso funcionando. Hacía falta de verdad un conocimiento especializado. No hay nada que corregir, y no debería contar como defecto en los números de nadie.

La categoría estructural es donde está el dinero, y es invisible para cualquier programa de escalamiento que solo evalúa el escalamiento en sí. Cuando cuarenta de los escalamientos del último trimestre necesitaron la misma aprobación de reembolso, que está un nivel por encima del primer nivel, no está viendo una carencia de formación. Está viendo un umbral de aprobación situado en el lugar equivocado, y puede ponerle precio a la solución contando los tickets.

Una nota sobre el costo, deliberadamente sin cifra. Es tentador multiplicar los escalamientos por un costo medio de gestión y sacar un titular. No lo haga, salvo que pueda defender los datos de partida: un escalamiento real cuesta como mínimo el tiempo de dos personas, normalmente la atención de un supervisor, la espera que vive el cliente y la mayor probabilidad de abandono que sigue a una mala recuperación, y nada de eso es constante entre tipos de caso. Cuente los tickets de la categoría estructural y describa la solución concreta que necesita cada grupo. Ese argumento resiste el escrutinio. Un costo por escalamiento inventado, no.

Lo que revelan los patrones de escalamiento en conjunto

Un escalamiento es una conversación de coaching. Cien escalamientos leídos juntos son un mapa de dónde falla el diseño de su servicio, y dicen cosas que ninguna revisión individual puede decir.

Cinco lecturas que conviene hacer cada mes

  • Concentración por tema. Agrupe los escalamientos por lo que quería el cliente, no por la etiqueta que puso el agente. Un puñado de temas produce casi siempre la mayor parte del volumen, y suelen ser casos límite de las políticas más que problemas complejos.
  • Mezcla de orígenes a lo largo del tiempo. Siga las cuatro categorías de atribución como proporciones. Si la parte de gestión baja mientras la estructural se mantiene, su coaching funciona y su proceso no.
  • Escalamientos repetidos. El mismo cliente, el mismo problema de fondo, escalado dos veces. Es el indicador individual más sólido de que la primera resolución fue cosmética, y conviene revisar cada caso a mano.
  • Tasas de rebote y de pregunta repetida por equipo receptor. Ponen en evidencia a los equipos que reciben trabajo para el que no están preparados, lo que es una conversación de enrutamiento más que de calidad.
  • Hora del día y plantilla. Los escalamientos que se concentran en los cambios de turno o en los huecos de cobertura son un hallazgo de turnos, y ningún coaching los va a mover.

El problema del denominador

Comparar la tasa de escalamiento entre agentes es la forma más rápida de perder al equipo, porque el agente de la cola más difícil es el que más escala. La tasa de escalamiento forma parte de sus demás indicadores de atención al cliente, y solo es comparable dentro de la misma cola, el mismo canal y una mezcla de casos parecida, e incluso entonces pertenece a una conversación y no a un ranking. Una tasa de escalamiento alta en trabajo complejo puede ser el comportamiento correcto. Una baja puede significar que un agente se niega a escalar lo que debería, que es el fallo más caro, y aparecerá en cambio como recontactos.

Por qué el muestreo se queda corto aquí

Los escalamientos son escasos por diseño, y eso es exactamente lo que los hace difíciles de revisar bien. Una pequeña muestra aleatoria de las conversaciones de un mes, tomada como se hace en la mayoría de los programas de muestreo de monitoreo de calidad, no contendrá casi ningún escalamiento, y los que contenga no serán representativos de los temas que los provocan. La mayoría de los equipos responde eligiendo a mano los escalamientos que revisa, lo que introduce otro sesgo: uno encuentra lo que fue a buscar. Revisar todos los escalamientos en lugar de una muestra es lo que convierte la anécdota en un patrón, y es el mismo argumento que hay detrás de la cobertura del 100% que revela tendencias que una muestra del 3% nunca podría mostrar (en inglés).

Ahí es donde la evaluación automatizada se gana su lugar, una vez que existe la rúbrica anterior y los revisores están de acuerdo con ella. El Auto QA de Kaizo aplica su propia rúbrica de escalamiento a cada conversación escalada, en lugar de al puñado que entra en la muestra, de modo que la concentración por tema y la mezcla de orígenes se cuentan en lugar de estimarse. Lo que importa más que la cobertura es que cada deducción queda vinculada al momento de la conversación que la causó, así que cuando un agente discute una nota en un ticket que heredó, el revisor puede mirar el intercambio en lugar de discutir de memoria. Lo que sale del conjunto alimenta después las conversaciones de coaching (en inglés) que vale la pena tener, y retira discretamente las que no.

Preguntas frecuentes

¿Qué es la gestión de escalamientos?

La gestión de escalamientos es el trabajo de resolver una conversación después de que su propiedad ha pasado de la persona que la recibió primero, normalmente porque el caso necesitaba más autoridad, más conocimiento especializado o una decisión que el primer agente no podía tomar. Abarca la transferencia en sí, la recuperación de un cliente que ya está frustrado, la exactitud de lo que se compromete y el cierre del ciclo tanto con el cliente como con el agente de origen. En control de calidad se trata como una categoría de trabajo propia, porque los criterios que juzgan un ticket rutinario no se aplican limpiamente a uno heredado.

¿Cómo se gestiona bien un escalamiento?

Lea el hilo completo antes de responder, para que el cliente nunca tenga que repetirse. Nombre lo que salió mal sin culpar a un compañero, a una política o al cliente. Use el margen de decisión por el que le escalaron el caso, porque un escalamiento que produce la misma respuesta de alguien de mayor rango no ha ayudado a nadie. Comprométase solo con lo que realmente vaya a ocurrir, en fechas reales. Después cierre el ciclo dos veces: comunique el resultado al cliente, y comunique la resolución al agente que escaló, para que el mismo escalamiento no se repita la semana siguiente.

¿Cuál es un ejemplo de escalamiento de un cliente?

Un agente que sigue la política le niega un reembolso a un cliente, que responde que es inaceptable y pide hablar con un supervisor. El ticket pasa a un supervisor con autoridad para hacer una excepción. Es un escalamiento jerárquico y exigido por el cliente, y es la forma más común. Otro ejemplo: una discrepancia de facturación que el primer nivel no puede ver en sus herramientas se deriva a un especialista de finanzas. Ese es funcional, nadie hizo nada mal y no debería contar en contra del primer agente.

¿Se deben evaluar los tickets escalados con la misma scorecard de QA?

No. Al menos cuatro criterios estándar engañan en un escalamiento. El tiempo de gestión castiga el trabajo más lento que el escalamiento existe para permitir, la adherencia a plantillas premia reutilizar la respuesta que el cliente ya rechazó, los criterios de saludo y apertura ignoran que la historia ya se contó una vez, y las notas de satisfacción califican en parte el contacto anterior en lugar del actual. Mantenga la exactitud y el cumplimiento de las políticas, elimine o sustituya el resto y añada criterios para la transferencia, la exactitud de los compromisos y el uso de la autoridad.

¿Cómo se mide la calidad en la gestión de escalamientos?

Use cuatro medidas juntas y ninguna por separado. Una nota de rúbrica sobre la conversación escalada que cubra absorción del contexto, reconocimiento, exactitud de los compromisos, uso de la autoridad y cierre del ciclo. La tasa de pregunta repetida, la proporción de escalamientos en los que quien recibe pidió algo que ya estaba en el hilo. La tasa de rebote, la proporción que se devuelve o se vuelve a transferir antes de resolverse. Y la tasa de escalamientos repetidos, la proporción en la que el mismo cliente escala el mismo problema dos veces, que es la señal más clara de que la primera resolución fue cosmética.

¿Cuál es una buena tasa de escalamiento?

No hay ningún benchmark que valga la pena citar, porque la cifra depende por completo de cómo defina un escalamiento, de cuál sea su producto y de cuánta autoridad tenga el primer nivel. Un equipo que cuenta cada derivación a un especialista como escalamiento reportará varias veces la tasa de un equipo que solo cuenta la intervención de un supervisor. Compare su tasa con su propia tendencia y con colas internas comparables, y preste más atención a la mezcla que al nivel. Una tasa estable con una proporción decreciente de escalamientos evitables es un programa que funciona.

¿A quién se debe evaluar cuando se escala un ticket?

A ambas personas, por cosas distintas. Al agente de origen se le evalúa por la transferencia que envió y por si su gestión causó el escalamiento. A quien recibe se le evalúa por el escalamiento en sí y nunca por el hecho de que exista. Si el escalamiento debió ocurrir se registra como un hallazgo aparte, con uno de cuatro orígenes: gestión, política, sistema o una expectativa creada en otro lugar. Cuando el origen es política, sistema o expectativa, no debería moverse ninguna nota a nivel de agente.

Términos relacionados

Descubra cuántos de sus escalamientos eran evitables

Traiga un mes de tickets escalados y la scorecard con la que los evalúa hoy. Le mostraremos dónde se crearon esos escalamientos, cuántos están en la categoría estructural que puede eliminar con un mejor diseño y qué cambia cuando la rúbrica se aplica a todos en lugar de a los pocos que entran en la muestra.

Reservar una demo Descubrir Agentic Auto QA

En esta página

Véalo en sus propias conversaciones

Evaluaremos una muestra de sus tickets reales con sus propios estándares, para que el ejemplo sea el suyo.

La confianza de equipos de atención al cliente de todo el mundo

  • Foot Locker
  • SteelSeries
  • Canva
  • GetYourGuide
  • Instacart