Economía del call center · 25 de agosto de 2026 · 10 min de lectura

Agente de voz con IA frente a un equipo de ventas real: cómo hacer una prueba justa

Una demo muestra que un agente de voz con IA sabe hablar; solo el tráfico real muestra si vende como sus operadores. Aquí se explica cómo repartir llamadas reales entre el agente y su equipo de ventas, con qué compararlo y dónde buscar el dinero más allá de la tasa de conversión.

UNA PRUEBA JUSTAUna demoMuestra que el agente sabe conversarTráfico realMuestra si vende como sus operadoresfrente aNuestro propio marco para una prueba justa: reparta llamadas reales entre elequipo y el agente con las mismas ofertas, mida a ambos por la tasa deaprobación y ubique al agente entre sus bandas de operadores.

La mayoría de las afirmaciones sobre agentes de voz se hacen contra una demo: una llamada con guion, un recorrido ideal, una grabación elegida a posteriori. Una demo muestra que un neuroagente puede sostener una conversación. Quien dirige una línea de ventas necesita una segunda respuesta: si vende tan bien como las personas que ya atienden sus teléfonos.

Solo una comparación con tráfico en vivo da esa respuesta. Cuesta más montarla que una demo y puede dejar mal parado a cualquiera de los dos lados, y justamente por eso vale la pena hacerla.

Un método para su propia prueba

Este artículo explica cómo hacer la comparación y cómo leerla. No incluye ninguna tasa de conversión, tamaño de plantilla ni costo de ninguna de nuestras cuentas, porque una cifra de una línea, un producto y un mercado le diría poco sobre los suyos. Las únicas cifras que siguen son de Gartner, cada una con su año.

Qué es la tasa de aprobación, y por qué es una métrica brutal

La tasa de aprobación son los pedidos confirmados sobre las llamadas atendidas. No leads, no interés, no una devolución de llamada aceptada: un pedido que el cliente confirmó de verdad en esa llamada. Es la cifra menos indulgente de la venta directa por teléfono, porque una mala conversación no tiene dónde esconderse. Una llamada acaba en pedido o no.

También tiene un suelo duro debajo. Por debajo de cierta tasa de aprobación, el gasto en medios que generó la llamada no se paga a sí mismo, así que conviene saber dónde está ese umbral en su propia cuenta antes de empezar la prueba. Mida el resultado contra esa cifra: el agente aprueba si supera la línea en la que la cuenta deja de perder dinero.

Primero, un periodo de calibración

Espere que las primeras semanas con tráfico real parezcan una calibración, porque eso es lo que son. El agente atiende a clientes reales, se equivoca, y cada llamada fallida vuelve esa misma semana al guion y al tratamiento de objeciones.

Júzguelo cuando termine ese periodo. Lo que mejora a un agente en sus primeras semanas son las transcripciones: lo que preguntan de verdad los clientes de este producto concreto y las objeciones que nadie anotó antes del lanzamiento. Evaluar esas semanas frente a un equipo que lleva años vendiendo el producto es comparar a un recién contratado con los veteranos.

Las semanas de calibración son aquellas en las que el guion se encuentra con las preguntas que nadie anotó.

Terminada la calibración, ponga las dos cifras lado a lado para las mismas semanas: la tasa de aprobación del agente y la del equipo, con las mismas ofertas y el mismo tráfico. Otro mes, otra combinación de ofertas o un piloto con las llamadas sobrantes cambian las condiciones, y entonces el resultado mide esas condiciones.

Lea el resultado con honestidad

Favorezca la media a quien favorezca, no se quede ahí. Una media de equipo mezcla a sus mejores operadores y a los más débiles, y la pregunta útil es a cuál de ellos se parece el agente cuando vende. Quien le prometa que un agente de voz venderá más que sus mejores operadores le promete algo que solo su propia prueba puede mostrar.

Dónde queda entre sus propios operadores

Una media de equipo esconde lo que importa, porque un mismo equipo reúne a personas que venden de forma muy distinta. Reparta a sus propios operadores según lo bien que venden de verdad, con las mismas ofertas y en las mismas semanas, y la comparación empieza a tener sentido:

Esta descripción es menos emocionante que la mayoría de las diapositivas de proveedor y mucho más útil para planificar, porque el grueso de un equipo está en la banda media. Un agente que vende como esa banda en cada turno y a cualquier hora es algo con lo que se puede planificar.

La parte que la cifra de conversión no muestra

La conversión es la mitad de la comparación. La otra mitad es cuántas llamadas puede tomar cada lado a medida que llegan. Un equipo tiene un número fijo de puestos en cada hora; un agente contesta las llamadas simultáneas a medida que entran, hasta la capacidad acordada para la línea. Registre las llamadas atendidas junto a la tasa de aprobación, por oferta y por hora, o la prueba pasará por alto la mitad en la que más se diferencian.

El tráfico generado por medios lo muestra bien. Las llamadas que provoca un anuncio de televisión o de radio no llegan de forma regular. Llegan en un pico, cuando se emite el anuncio, y un equipo dimensionado para el pico está inactivo el resto del día, mientras que un equipo dimensionado para la media deja caer el pico.

El equipo no pierde el pico porque venda mal. Pierde el pico porque es finito.

En qué se va realmente el mes de un operador

Antes de comparar costos, mire qué contiene una hora pagada del equipo. Tome un mes de sus propios informes de personal y reparta el tiempo pagado entre:

La conversación es solo una línea de esa lista, y en un equipo dimensionado para un pico que nadie puede prever, la que crece es la espera. Es la aritmética de dimensionar una plantilla para un pico, sea quien sea el equipo. Gartner situó en 2022 la parte laboral del costo de un centro de contacto hasta en el 95 %, así que una hora esperando el teléfono es casi todo costo y nada de ingresos.

Por qué no publicamos un ratio de costo

Un ratio de costo entre un agente y un operador está hecho de salarios locales, y cualquier ratio que publicáramos metería la nómina de otra empresa en su caso de negocio. Las propias cifras de Gartner de 2025 sitúan un contacto en autoservicio en 1,84 dólares frente a 13,50 dólares de un contacto asistido, aproximadamente siete a uno; use eso como la forma y su propia nómina como la cifra.

Dónde sirve la prueba, y dónde no

Una prueba con tráfico repartido le dice lo que pasa en su línea, con sus ofertas y sus clientes, y nada más. Las llamadas transaccionales cortas están cerca del caso más fácil para la automatización: pocas preguntas y una decisión tomada durante la llamada. Una compra reflexionada, una línea B2B o cualquier venta en la que el cliente necesite una semana para decidir pide una prueba propia, y un resultado en una no se traslada a la otra.

La prueba tampoco es un plan de plantilla. Una encuesta de Gartner de 2025 encontró que solo el 20 % de las organizaciones de servicio recorta plantilla de verdad después de desplegar IA. Donde un agente se paga solo, mire primero las llamadas que el equipo dejaba caer en el pico: aparecen en los ingresos.

Cómo hacer la prueba

  1. Reparta tráfico real, no ponga un piloto al lado de la realidad. La única comparación que vale algo son las mismas ofertas, las mismas horas, los mismos clientes.
  2. Concédale un periodo de calibración y espere mediocridad. Devuelva cada llamada fallida al guion y no evalúe al agente hasta que ese periodo termine.
  3. Mida la métrica por la que la cuenta se juzga de verdad. La tasa de aprobación es incómoda precisamente porque no se puede maquillar con un tono más cálido.
  4. Apúntelo primero al pico. Ahí es donde su equipo está perdiendo llamadas que nunca verá, y donde la capacidad pesa más.
  5. Compárelo con sus bandas, no con su media. Si queda por encima de su banda débil, ese es un resultado real, y su media nunca fue una persona.

La pregunta que vale la pena responder es más estrecha que la de la mayoría de las diapositivas de proveedor: en sus propias llamadas, ¿a cuál de sus operadores se parece el agente cuando vende, y qué pasa con las llamadas que nadie del equipo estaba libre para atender?

Preguntas frecuentes sobre agentes de voz y conversión

¿Convierte un agente de voz con IA mejor que los operadores humanos?
Nadie puede responderlo para su línea sin probarlo en ella. Reparta llamadas reales entre el agente y su equipo con las mismas ofertas, y luego compare al agente con cada una de sus bandas de operadores: superar sus bandas débil y novata es un resultado real, e igualar a sus mejores operadores es una afirmación que conviene verificar dos veces.
¿Qué es la tasa de aprobación?
Pedidos confirmados divididos entre llamadas atendidas, en una línea entrante de respuesta directa; cuenta como pedido el que el cliente aceptó en la llamada. Es la métrica de la que vive este tipo de cuenta, y por debajo de un umbral que cada cuenta tiene que calcular por sí misma, el gasto en medios que generó la llamada deja de pagarse.
¿Por qué darle al agente un periodo de calibración?
Porque las primeras semanas con tráfico real son cuando el guion se encuentra con las preguntas que nadie anotó. Cada llamada fallida vuelve al guion y al tratamiento de objeciones; evaluar al agente antes de terminar ese trabajo es comparar a un recién contratado con operadores que llevan años vendiendo el producto.
¿Por qué no hay una cifra de ahorro en este artículo?
Porque un ratio de costo entre un agente y un operador está hecho de salarios locales y engañaría a cualquiera cuya nómina sea distinta. Las cifras de Gartner de 2025 sitúan un contacto en autoservicio en 1,84 dólares frente a 13,50 dólares de un contacto asistido, alrededor de siete a uno; esa es la forma del ahorro. Su propia nómina fija el tamaño.
¿Un agente de voz con IA permite reducir plantilla?
No lo planifique así: una encuesta de Gartner de 2025 encontró que solo el 20 % de las organizaciones de servicio recorta plantilla de verdad después de desplegar IA. Busque la ganancia en el pico de tráfico que hoy se queda sin atender, que aparece como ingresos. Planifique a partir de las llamadas que hoy pierde.
¿Funcionaría esto en una compra reflexionada o en B2B?
No sin una prueba propia. Las llamadas transaccionales cortas están cerca del caso más fácil que hay: un conjunto estrecho de preguntas y una decisión tomada durante la llamada. Un ciclo de venta largo con varios interlocutores es otro problema: ahí un agente sirve sobre todo para la calificación y el seguimiento, y el cierre queda en manos de su equipo.