Gabriel Herencia

~/insights / Automatización

WhatsApp cobra por mensaje desde el 1 de octubre: por qué tu chatbot de menús se volvió caro (y cuándo un agente de IA sale más barato)

Desde el 1/10/2026 la API de WhatsApp cobra cada mensaje de servicio entregado. Contrasté lo que circula en videos con la documentación oficial de Meta y armé un modelo de costos: un bot de menús de 12 mensajes contra agentes de IA con modelos de OpenAI y Anthropic, solos o combinados con Jev como clasificador, en Perú, Argentina, Chile, México, Brasil y Colombia. Dónde el agente ahorra miles de dólares, dónde no conviene y por qué el rival real son las listas interactivas.

·12 min de lectura
AutomatizaciónIAAutomatizaciónToma de decisionesAgentes de IACostosWhatsApp
Portada: WhatsApp cobra por mensaje desde el 1 de octubre: por qué tu chatbot de menús se volvió caro (y cuándo un agente de IA sale más barato)

Desde el 1 de octubre de 2026 la API de WhatsApp (Cloud API) cobra cada mensaje de servicio entregado: las respuestas libres dentro de la ventana de 24 horas, que eran gratis desde noviembre de 2024. En redes circulan videos y webinars con datos a medias, así que fui a la documentación oficial de Meta, contrasté cada afirmación y armé un modelo de costos para responder la pregunta que me importa como alguien que construye agentes de WhatsApp: ¿un chatbot de menús sigue teniendo sentido cuando cada "volver al menú" se cobra?

Datos verificados el 29/09/2026 contra las páginas de pricing de Meta (actualizadas el 28/09/2026). Las tarifas cambian por trimestre: revísalas antes de decidir.

Primero, separemos los dos WhatsApp

Casi toda la confusión viene de mezclar dos productos distintos:

App WhatsApp Business (el celular)WhatsApp Cloud API (plataformas, CRMs, bots)
¿Cambia el 1/10?No hay cobro nuevo por responderSí: se cobra cada mensaje de servicio entregado
Responder a manoGratis—
Qué se pagaDifusiones (broadcasts), paquetes de mensajes, suscripción Meta OneMensajes salientes entregados
EscalaPensada para pocos chatsMiles de conversaciones simultáneas

Si respondes a mano desde el celular, el cobro del 1 de octubre no te toca. Si tienes un bot, un CRM o una IA conectada por API, sí. Con coexistencia (el mismo número en la app y en la API) se paga solo lo que sale por la API; lo que envías desde el celular sigue gratis.

Lo que cambia en la API, según Meta

  • Mensajes de servicio pagos desde el 1/10: cualquier mensaje que no sea plantilla (texto, audio, imagen, lista, botones) cuenta como uno. Se cobra el entregado, no el enviado.
  • Capa gratuita: 1.000 mensajes de servicio por mes, por número (no por empresa). No se acumulan, se reinician cada mes y no cubren plantillas.
  • Tarifa = la de utilidad del país del destinatario. No importa dónde esté tu empresa ni de qué país sea tu número.
  • Sin descuentos por volumen para mensajes de servicio.
  • Las plantillas de utilidad dentro de la ventana de 24 h también pasan a cobrarse (eran gratis desde julio de 2025).
  • Los mensajes que te manda el cliente son gratis. Siempre.
  • Método de pago antes del 30/09. Las páginas de Meta no son del todo consistentes sobre qué pasa si no lo tienes (una dice que se cortan los mensajes de servicio; otra, que se cortan al superar los 1.000 gratis). No lo averigües en producción: agrégalo ya.

Tarifas por mensaje (USD, vigentes desde el 1/10/2026)

PaísServicio = UtilidadMarketing
Perú0,03000,0703
Argentina0,02600,0618
Chile0,02000,0889
México0,00850,0397
Brasil0,00680,0625
Colombia0,00080,0125

Perú cuesta 37 veces lo que Colombia por el mismo mensaje. Si vendes a varios países, tu costo depende de dónde están tus clientes.

Lo que circula y no es tan así

  • "La ventana gratis de los anuncios dura 72 horas." Hoy la documentación de Meta dice que la ventana de Free Entry Point (conversación que nace de un anuncio Click-to-WhatsApp) puede quedar abierta hasta 7 días, y que dentro de ella todo es gratis, incluidas plantillas de marketing. Condición: responder dentro de las primeras 24 h. Ojo: aplica a anuncios abiertos desde la app móvil; lo del botón de Instagram no lo encontré confirmado.
  • "WhatsApp Business limita a 250 chats nuevos por mes." No hay ninguna página oficial con ese número para la app. Lo que sí existe: Meta confirmó en 2025 que probaba límites mensuales a mensajes sin respuesta (si la persona contesta, no cuenta), sin publicar cifras ni países. Por eso circulan capturas con "76 de 150" y otras con números distintos. El "250" parece venir de otro lado: es el límite inicial de la API, y es por 24 horas, no por mes.
  • "Meta One te sube el límite de mensajes." Meta One existe (desde USD 14,99 hasta USD 499/mes en planes para negocios: verificación, más dispositivos, página propia, créditos de difusión y de IA), pero ninguna página oficial dice que aumente el límite para iniciar chats. Y la insignia de verificado depende de que Meta verifique tu negocio: pagar no la garantiza.
  • "Si mando audio en vez de texto no me cobran." Se cobra por mensaje entregado, sea del tipo que sea.

El consejo de fondo de esos videos sí es correcto: no insistas a quien no responde. Sube tu riesgo de reportes y bloqueos, y ahora además cuesta.

Mi tesis: el chatbot de menús es el que más sufre

Un bot de opciones clásico ("marca 1 para ventas, 2 para soporte") está diseñado para un mundo donde el mensaje saliente era gratis. Cada paso del árbol es un mensaje:

  1. Bienvenida
  2. Menú principal
  3. Submenú
  4. "Opción inválida" (el cliente escribió texto libre, como hace todo el mundo)
  5. Submenú otra vez
  6. Lista de productos
  7. Detalle y precio
  8. Stock
  9. Menú principal de nuevo (el cliente marcó "0 para volver")
  10. "Ingresa el código del producto"
  11. Link de pago
  12. Despedida

12 mensajes cobrados para responder "¿cuánto sale y tienen stock?". El retroceso entre opciones es lo peor: cada "volver" reenvía menú y submenú. En Perú, un solo retroceso por conversación a 300 conversaciones por día son USD 540 al mes solo en idas y vueltas.

Un agente de IA entiende texto libre y resuelve lo mismo en 3 mensajes: precio + stock + una pregunta consolidada; link de pago con resumen; cierre. Pero agrega un costo que el menú no tiene: tokens.

El cálculo: WhatsApp vs tokens, con varios modelos

Un agente no tiene por qué ser un solo modelo. Precios oficiales al 29/09/2026 (USD por millón de tokens):

ModeloPara qué lo usaría en el agenteEntradaEntrada en cachéSalida
Jev (TypeSafe)Clasificar y enrutar: intención, urgencia, ¿necesita humano?0,042—gratis
GPT-5.4-nano (OpenAI)Preguntas frecuentes y respuestas simples0,200,021,25
GPT-5-mini (OpenAI)Flujo transaccional con herramientas0,250,0252,00
GPT-5.4-mini (OpenAI)Lo mismo, con más capacidad0,750,0754,50
Claude Haiku 4.5 (Anthropic)Flujo transaccional con herramientas1,000,105,00
Claude Sonnet 5.5 (Anthropic)Casos complejos: reclamos, negociación, excepciones2,000,2010,00

Supuestos del agente: prompt de sistema + herramientas + catálogo resumido de ~5.000 tokens (cacheado), 5 llamadas al modelo por conversación (dos para herramientas) y respuestas de ~150 tokens. Para Sonnet 5.5 sumé un 30 % de tokens, porque su tokenizer produce más tokens para el mismo texto.

La arquitectura híbrida

En lugar de mandar todo al mismo modelo, un grafo de agente (LangGraph o el orquestador que tengas) usa a Jev como primer filtro y deriva cada caso al modelo más barato que lo resuelve bien:

renderizando diagrama…

Además de bajar tokens, baja mensajes: una pregunta frecuente se resuelve en 2 mensajes, no en 3. Con esa mezcla, el promedio queda en 2,6 mensajes por conversación.

ArquitecturaLLM por conversaciónLLM al mes (9.000 conversaciones)
Solo GPT-5-miniUSD 0,0019USD 17
Solo GPT-5.4-miniUSD 0,0049USD 44
Solo Claude Haiku 4.5USD 0,0064USD 58
Solo Claude Sonnet 5.5USD 0,0166USD 150
Híbrido (Jev + GPT-5.4-nano + GPT-5-mini + Sonnet 5.5)USD 0,0026USD 23

Jev cuesta menos de una centésima de centavo por conversación: clasificar es prácticamente gratis.

El total: WhatsApp + tokens

Costo mensual con un número, restando los 1.000 mensajes gratis:

30 conversaciones por día (900/mes)

PaísMenú (12 msj)Solo GPT-5-miniSolo Haiku 4.5Solo Sonnet 5.5Híbrido
PerúUSD 294USD 53USD 57USD 66USD 43
ArgentinaUSD 255USD 46USD 50USD 59USD 37
ChileUSD 196USD 36USD 40USD 49USD 29
MéxicoUSD 83USD 16USD 20USD 29USD 14
BrasilUSD 67USD 13USD 17USD 27USD 11
ColombiaUSD 7,8USD 3,0USD 7,1USD 16USD 3,4

300 conversaciones por día (9.000/mes)

PaísMenú (12 msj)Solo GPT-5-miniSolo Haiku 4.5Solo Sonnet 5.5Híbrido
PerúUSD 3.210USD 797USD 838USD 930USD 695
ArgentinaUSD 2.782USD 693USD 734USD 826USD 606
ChileUSD 2.140USD 537USD 578USD 670USD 471
MéxicoUSD 910USD 238USD 279USD 371USD 214
BrasilUSD 728USD 194USD 234USD 327USD 176
ColombiaUSD 86USD 38USD 78USD 171USD 41

Lo que dicen las tablas:

  • En los países caros, lo que mueve la factura son los mensajes, no los tokens. En Perú, pasar del menú a cualquier agente ahorra entre USD 2.280 y 2.515 al mes; entre el modelo más barato y el más caro hay apenas USD 235.
  • El híbrido gana casi siempre, porque ahorra tokens y mensajes.
  • En Colombia los tokens sí pesan. Un agente con Sonnet 5.5 para todo cuesta el doble que el menú; con GPT-5-mini o el híbrido, menos de la mitad.

La regla para decidir sigue siendo:

tarifa del país  >  costo de tokens por conversación / mensajes que ahorra

Contra un menú de 12 mensajes, el punto de equilibrio es de USD 0,0002 por mensaje con GPT-5-mini, 0,0003 con el híbrido, 0,0007 con Haiku 4.5 y 0,0019 con Sonnet 5.5. Colombia (0,0008) queda por encima de los tres primeros y por debajo de Sonnet: ahí el modelo que elijas decide si ahorras o pierdes.

Tres matices que cambian la conclusión

1. El rival real no es el menú: son las listas interactivas. WhatsApp tiene mensajes con listas y botones, y cada uno cuenta como un mensaje. Un bot bien hecho con listas resuelve el mismo caso en ~5 mensajes, sin IA. Contra eso, el agente ahorra solo 2 mensajes por conversación (2,4 el híbrido) y el equilibrio sube: ≈ USD 0,0009 con GPT-5-mini, 0,0011 con el híbrido, 0,0032 con Haiku 4.5 y 0,0083 con Sonnet 5.5. En Perú, Argentina y Chile cualquier agente sigue ganando; en México y Brasil conviene uno liviano o el híbrido; en Colombia gana el bot de listas. Antes de meter IA, pregúntate si tu problema no se resuelve con listas.

2. La arquitectura importa más que el modelo. Mandar todo a un modelo de frontera cuesta ~6 veces más en tokens que el híbrido, y los modelos más grandes (como Claude Opus o los GPT de razonamiento) no hacen falta para vender por WhatsApp: se reservan para lo que de verdad los necesita. Tres palancas: prompt caching (sin caché, el mismo agente cuesta ~5 veces más), un clasificador barato adelante (sobre Jev escribí en jev-la-ia-que-no-escribe-decide-el-primer-filtro-que-les-faltaba-a-los-agentes) y modelos pequeños por defecto. Dos advertencias: los modelos más pequeños se equivocan más al usar herramientas, así que evalúa cada ruta con conversaciones reales antes de confiarle ventas; y los números de Jev son los que publica TypeSafe. Como referencia, el agente propio de Meta (Meta Business Agent) se cobra aparte por tokens, ≈ 4–5 centavos por mensaje según Meta, y no es gratis ni dentro de la ventana de los anuncios.

3. Con anuncios Click-to-WhatsApp, WhatsApp cuesta cero. Dentro de esa ventana cualquier bot sale gratis, así que el agente es costo puro (≈ USD 2 al mes cada 900 conversaciones con el híbrido; ≈ USD 6 con Haiku 4.5). Ahí no se justifica por ahorro sino por conversión: si un agente vende más que un menú, se paga igual. Y medir eso bien implica cruzar anuncios, WhatsApp y ventas; es el tipo de hueco que describí en tres-mcps-y-una-ia-los-huecos-que-ningun-dashboard-te-muestra.

Qué haría esta semana

  1. Agrega el método de pago en tu cuenta de la API antes del 30/09.
  2. Cuenta mensajes por atención, no conversaciones. Ese número es el que se vuelve factura en octubre. Los webhooks ya marcan cada mensaje como billable y con su category.
  3. Junta mensajes. Nada de "Hola 👋" + "¿Cómo estás?" + "Estos son los precios" por separado, ni "dame un segundo que lo busco" antes de la respuesta: son tres cobros donde alcanza uno.
  4. Revisa los automatismos silenciosos: recordatorios de inactividad, "¿sigues ahí?", encuestas de dos pasos, despedidas automáticas. Si nadie responde, son costo sin retorno.
  5. Reemplaza árboles de menús por listas o botones antes de pensar en IA.
  6. Si usas un agente, haz la cuenta con la tarifa del país de tus clientes, con caché activada, un clasificador adelante y un modelo pequeño por defecto.
  7. Prueba tráfico desde anuncios Click-to-WhatsApp y compara la conversión contra tu landing: si convierte parecido, te ahorras los mensajes.

Lo importante

Que WhatsApp cobre por mensaje no mata a los bots: castiga a los bots verbosos. La métrica que importa pasa a ser mensajes por objetivo resuelto. Un agente de IA bien diseñado la baja mucho, y combinando modelos (un clasificador barato, un modelo pequeño para lo simple y uno grande solo para lo complejo) el costo en tokens es casi anecdótico frente al de WhatsApp. En Perú o Chile ahorra miles de dólares al mes; en Colombia, el modelo que elijas decide si ahorras o pierdes. Haz la cuenta con tus números antes de elegir.


Fuentes oficiales