Atención al cliente por WhatsApp con IA: la ventana de 24 horas manda
Responder dentro de la ventana no cuesta nada. Responder tarde cuesta una plantilla.
Escrito por
xcale Team
Equipo xcale · The xcale Team

La atención al cliente por WhatsApp con IA suele venderse como un ahorro de personal. En LATAM el argumento real es otro, y es más simple: desde el 1 de noviembre de 2024 Meta hizo gratuitas las conversaciones de servicio, así que todo lo que respondes dentro de la ventana de 24 horas que abre el cliente no te cuesta nada. Cuando esa ventana se cierra, la misma respuesta pasa a costar una plantilla aprobada. Contestar rápido dejó de ser una métrica de calidad y se volvió una línea de costo.
Esta guía es lo que hay que decidir antes de encender nada: qué preguntas puede contestar una IA, cómo se arma, dónde tiene que parar y qué medir para saber si sirvió.
Por qué en WhatsApp la atención al cliente es un problema de reloj
xcale
Prueba xcale gratis por 7 días
Tu agente configurado, conectado a tu stack y respondiendo en WhatsApp — en horas, no semanas.
En WhatsApp no hay cola ni sesión. Hay un hilo que no se cierra nunca y un reloj que sí. Tres reglas de Meta definen toda la operación:
- Cuando el cliente te escribe se abre una ventana de atención de 24 horas. Dentro de ella respondes con texto libre, sin plantillas y sin formato: es una conversación normal.
- Desde el 1 de noviembre de 2024 esas conversaciones de servicio son gratuitas para todos los negocios, según la propia página de precios de Meta. No hay tarifa por responderle a alguien que te escribió primero.
- Desde el 1 de julio de 2025 Meta cobra por mensaje entregado, no por conversación de 24 horas. Fuera de la ventana solo puedes escribir con una plantilla aprobada, y esa sí se cobra.
Léelo al derecho: el canal te regala la atención y te cobra la interrupción. Un negocio que contesta las preguntas del día dentro del mismo día opera este canal casi gratis. Uno que contesta a los tres días paga una plantilla cada vez que necesita reabrir la conversación, y además llega tarde a una decisión que el cliente ya tomó con otro proveedor.
Hay una excepción a favor: los chats que entran desde un anuncio click-to-WhatsApp abren una ventana de 72 horas en la que todo lo que envías es gratuito. Si compras tráfico, ahí tienes tres días completos de atención sin costo por mensaje. El detalle de tarifas, categorías de plantilla y límites está en la guía de la API de WhatsApp Business.
Qué preguntas puede contestar una IA, y cuáles no
La respuesta honesta no depende de la IA. Depende de si tu negocio ya decidió cuál es la respuesta.
Un agente puede resolver, sin supervisión, lo que ya está escrito en algún lado:
- Estado de un pedido, tiempos de entrega y cobertura por zona.
- Horarios, ubicación, formas de pago y requisitos para comprar o para agendar.
- Precio y disponibilidad de lo que está en el catálogo.
- Política de garantía, cambios y devoluciones, cuando existe y está redactada.
- Cómo se usa, se instala o se activa algo que ya documentaste.
Y hay una lista corta que no se automatiza nunca, más corta de lo que la gente teme y menos negociable de lo que le gustaría:
- Reclamos y clientes molestos. Alguien enojado que recibe una respuesta automática se enoja más. Eso escala en el primer mensaje, no en el tercero.
- Compensaciones y excepciones. Regalar un envío, extender una garantía o devolver dinero es una decisión de negocio, no una redacción.
- Consejo profesional. Diagnósticos, dosis, indicaciones clínicas, asesoría legal o tributaria.
- Malas noticias. Un pedido retrasado, una cancelación, un aumento de precio. Eso se comunica con nombre y apellido.
- Lo que no está escrito en ninguna parte. Si el negocio no tiene una política definida, ningún sistema la puede inventar. La respuesta correcta ahí es "déjame confirmarlo con el equipo".
La prueba no es si la IA sabe redactar la respuesta. Es si tu negocio ya decidió cuál es.
El orden general de qué automatizar primero, y por qué la primera respuesta rinde más que cualquier otra cosa, está en cómo automatizar WhatsApp.
Cómo montar la atención al cliente por WhatsApp con IA, paso a paso
Cinco pasos, en este orden. Los tres primeros no requieren comprar nada.
1. Cuenta las preguntas, no las funciones. Abre los últimos doscientos chats y clasifícalos por tema. No estás buscando un promedio: estás buscando la lista corta de preguntas que se repiten todas las semanas. Esa lista es el alcance del proyecto y también su criterio de éxito.
2. Escribe las respuestas antes de comprar nada. Este es el trabajo real y es donde se cae la mayoría de los proyectos. Cada pregunta repetida necesita una respuesta escrita, con su excepción y su límite: cuánto cuesta el envío a zona rural, qué pasa si el producto llegó abierto, hasta cuándo se puede cambiar. En xcale eso vive como documentos y FAQs que el agente recupera por búsqueda semántica —no por palabras clave—, y se puede asignar una base distinta a cada agente.
3. Define el escalamiento antes de encender. Escribe las reglas por tema (reclamos, devoluciones de dinero, salud) y por señal (el cliente pide hablar con una persona, repite la misma pregunta, cambia el tono). Un agente sin reglas de escalamiento no es un riesgo teórico: es un cliente molesto conversando con un sistema.
4. Decide de quién es el hilo. En WhatsApp la conversación es una sola y permanente, así que alguien tiene que poder tomarla en cualquier momento sin cortar nada. La transferencia a una persona debe ser inmediata y sin reiniciar el contexto.
5. Instrumenta el reloj. Mide cuántas conversaciones se resuelven dentro de la ventana de 24 horas antes de mirar cualquier otra cosa. Es la única métrica que a la vez describe el servicio y el costo.
El escalamiento no es el plan B: es el diseño
La parte que decide si esto funciona no es lo que el agente contesta, sino cómo entrega lo que no puede contestar.
Cuando un agente escala mal, el cliente vuelve a empezar: repite el número de pedido, repite el problema, repite lo que ya intentó. Ese es el momento exacto en el que la automatización se vuelve más cara que atender a mano, porque el cliente ya gastó paciencia dos veces.
Un escalamiento bien hecho entrega tres cosas a la persona que recibe: la conversación completa, lo que el agente ya verificó, y por qué se detuvo. La persona entra sabiendo más que el cliente, no menos. En xcale eso son reglas de escalamiento configurables, una cola priorizada y el historial completo del hilo, sin que nadie tenga que reconstruirlo.
Que el agente recuerde al cliente entre conversaciones —y no solo dentro de una— es un problema distinto y más profundo: está en memoria persistente en agentes de IA.
Qué medir, y por qué la tasa de desvío es la métrica equivocada
La "tasa de desvío" viene del chat web y del call center, donde cada contacto cuesta minutos de un agente humano y el objetivo es evitar el contacto. En WhatsApp ese cálculo no aplica: dentro de la ventana el contacto es gratis y el hilo es permanente. Un cliente "desviado" que no vuelve a escribir puede ser un cliente perdido, no un costo ahorrado.
Cinco números que sí describen la operación:
- Tiempo hasta la primera respuesta útil. No hasta el primer mensaje: un acuse de recibo automático no es una respuesta.
- Porcentaje de conversaciones resueltas dentro de la ventana de 24 horas. Servicio y costo en el mismo número.
- Tasa de escalamiento con su motivo. Una tasa que baja sin motivos registrados no es una mejora, es una advertencia.
- Recontacto a siete días por el mismo tema. Mide si la respuesta resolvió o solo cerró.
- Plantillas pagadas por conversación reabierta. El costo directo de haber contestado tarde.
Sobre benchmarks: no existe un estudio creíble de tiempos de respuesta o de resolución segmentado por tamaño de empresa para pymes de LATAM, así que no vas a encontrar aquí una cifra de referencia. Lo que sí hay es evidencia sobre la disposición del cliente. En el estudio de Kantar para Meta The State of Business Messaging —11.056 adultos, 22 mercados incluidos México y Colombia, campo entre abril y septiembre de 2025—, 67,7% está de acuerdo con que recibir la respuesta de un chatbot de IA es útil, mientras que solo 42,9% cree que la IA mejoraría su experiencia de mensajería. La brecha de casi 25 puntos es la distancia entre "me contestaron rápido" y "me entendieron", y es exactamente donde se gana o se pierde este proyecto.
Cómo empezar esta semana
Toma las cinco preguntas más repetidas de los últimos doscientos chats, escribe sus respuestas con excepciones incluidas, y define qué temas escalan siempre. Eso es una tarde de trabajo y es lo único que no puede hacer ningún proveedor por ti.
Después conecta tu número. El agente de soporte de xcale lee la pregunta, responde con tu base de conocimiento, escala lo que definiste que escala y deja el contexto completo para quien reciba. Son 7 días de prueba gratis: tiempo suficiente para medir cuántas de las preguntas de esta semana se resolvieron dentro de la ventana de 24 horas, que es la pregunta que importa. Los planes y precios están publicados.
Preguntas frecuentes
Responder dentro de la ventana de atención de 24 horas que abre el cliente no tiene costo: desde el 1 de noviembre de 2024 Meta hizo gratuitas las conversaciones de servicio para todos los negocios. Desde el 1 de julio de 2025 Meta cobra por mensaje entregado, y fuera de esa ventana solo puedes escribir con una plantilla aprobada, que sí se cobra. En la práctica: contestar es gratis, interrumpir tiene precio.


