Desde el 1 de octubre de 2026 la API de WhatsApp (Cloud API) cobra cada mensaje de servicio entregado: las respuestas libres dentro de la ventana de 24 horas, que eran gratis desde noviembre de 2024. En redes circulan videos y webinars con datos a medias, así que fui a la documentación oficial de Meta, contrasté cada afirmación y armé un modelo de costos para responder la pregunta que me importa como alguien que construye agentes de WhatsApp: ¿un chatbot de menús sigue teniendo sentido cuando cada "volver al menú" se cobra?
Datos verificados el 29/09/2026 contra las páginas de pricing de Meta (actualizadas el 28/09/2026). Las tarifas cambian por trimestre: revísalas antes de decidir.
Primero, separemos los dos WhatsApp
Casi toda la confusión viene de mezclar dos productos distintos:
| App WhatsApp Business (el celular) | WhatsApp Cloud API (plataformas, CRMs, bots) | |
|---|---|---|
| ¿Cambia el 1/10? | No hay cobro nuevo por responder | Sí: se cobra cada mensaje de servicio entregado |
| Responder a mano | Gratis | — |
| Qué se paga | Difusiones (broadcasts), paquetes de mensajes, suscripción Meta One | Mensajes salientes entregados |
| Escala | Pensada para pocos chats | Miles de conversaciones simultáneas |
Si respondes a mano desde el celular, el cobro del 1 de octubre no te toca. Si tienes un bot, un CRM o una IA conectada por API, sí. Con coexistencia (el mismo número en la app y en la API) se paga solo lo que sale por la API; lo que envías desde el celular sigue gratis.
Lo que cambia en la API, según Meta
- Mensajes de servicio pagos desde el 1/10: cualquier mensaje que no sea plantilla (texto, audio, imagen, lista, botones) cuenta como uno. Se cobra el entregado, no el enviado.
- Capa gratuita: 1.000 mensajes de servicio por mes, por número (no por empresa). No se acumulan, se reinician cada mes y no cubren plantillas.
- Tarifa = la de utilidad del país del destinatario. No importa dónde esté tu empresa ni de qué país sea tu número.
- Sin descuentos por volumen para mensajes de servicio.
- Las plantillas de utilidad dentro de la ventana de 24 h también pasan a cobrarse (eran gratis desde julio de 2025).
- Los mensajes que te manda el cliente son gratis. Siempre.
- Método de pago antes del 30/09. Las páginas de Meta no son del todo consistentes sobre qué pasa si no lo tienes (una dice que se cortan los mensajes de servicio; otra, que se cortan al superar los 1.000 gratis). No lo averigües en producción: agrégalo ya.
Tarifas por mensaje (USD, vigentes desde el 1/10/2026)
| País | Servicio = Utilidad | Marketing |
|---|---|---|
| Perú | 0,0300 | 0,0703 |
| Argentina | 0,0260 | 0,0618 |
| Chile | 0,0200 | 0,0889 |
| México | 0,0085 | 0,0397 |
| Brasil | 0,0068 | 0,0625 |
| Colombia | 0,0008 | 0,0125 |
Perú cuesta 37 veces lo que Colombia por el mismo mensaje. Si vendes a varios países, tu costo depende de dónde están tus clientes.
Lo que circula y no es tan así
- "La ventana gratis de los anuncios dura 72 horas." Hoy la documentación de Meta dice que la ventana de Free Entry Point (conversación que nace de un anuncio Click-to-WhatsApp) puede quedar abierta hasta 7 días, y que dentro de ella todo es gratis, incluidas plantillas de marketing. Condición: responder dentro de las primeras 24 h. Ojo: aplica a anuncios abiertos desde la app móvil; lo del botón de Instagram no lo encontré confirmado.
- "WhatsApp Business limita a 250 chats nuevos por mes." No hay ninguna página oficial con ese número para la app. Lo que sí existe: Meta confirmó en 2025 que probaba límites mensuales a mensajes sin respuesta (si la persona contesta, no cuenta), sin publicar cifras ni países. Por eso circulan capturas con "76 de 150" y otras con números distintos. El "250" parece venir de otro lado: es el límite inicial de la API, y es por 24 horas, no por mes.
- "Meta One te sube el límite de mensajes." Meta One existe (desde USD 14,99 hasta USD 499/mes en planes para negocios: verificación, más dispositivos, página propia, créditos de difusión y de IA), pero ninguna página oficial dice que aumente el límite para iniciar chats. Y la insignia de verificado depende de que Meta verifique tu negocio: pagar no la garantiza.
- "Si mando audio en vez de texto no me cobran." Se cobra por mensaje entregado, sea del tipo que sea.
El consejo de fondo de esos videos sí es correcto: no insistas a quien no responde. Sube tu riesgo de reportes y bloqueos, y ahora además cuesta.
Mi tesis: el chatbot de menús es el que más sufre
Un bot de opciones clásico ("marca 1 para ventas, 2 para soporte") está diseñado para un mundo donde el mensaje saliente era gratis. Cada paso del árbol es un mensaje:
- Bienvenida
- Menú principal
- Submenú
- "Opción inválida" (el cliente escribió texto libre, como hace todo el mundo)
- Submenú otra vez
- Lista de productos
- Detalle y precio
- Stock
- Menú principal de nuevo (el cliente marcó "0 para volver")
- "Ingresa el código del producto"
- Link de pago
- Despedida
12 mensajes cobrados para responder "¿cuánto sale y tienen stock?". El retroceso entre opciones es lo peor: cada "volver" reenvía menú y submenú. En Perú, un solo retroceso por conversación a 300 conversaciones por día son USD 540 al mes solo en idas y vueltas.
Un agente de IA entiende texto libre y resuelve lo mismo en 3 mensajes: precio + stock + una pregunta consolidada; link de pago con resumen; cierre. Pero agrega un costo que el menú no tiene: tokens.
El cálculo: WhatsApp vs tokens, con varios modelos
Un agente no tiene por qué ser un solo modelo. Precios oficiales al 29/09/2026 (USD por millón de tokens):
| Modelo | Para qué lo usaría en el agente | Entrada | Entrada en caché | Salida |
|---|---|---|---|---|
| Jev (TypeSafe) | Clasificar y enrutar: intención, urgencia, ¿necesita humano? | 0,042 | — | gratis |
| GPT-5.4-nano (OpenAI) | Preguntas frecuentes y respuestas simples | 0,20 | 0,02 | 1,25 |
| GPT-5-mini (OpenAI) | Flujo transaccional con herramientas | 0,25 | 0,025 | 2,00 |
| GPT-5.4-mini (OpenAI) | Lo mismo, con más capacidad | 0,75 | 0,075 | 4,50 |
| Claude Haiku 4.5 (Anthropic) | Flujo transaccional con herramientas | 1,00 | 0,10 | 5,00 |
| Claude Sonnet 5.5 (Anthropic) | Casos complejos: reclamos, negociación, excepciones | 2,00 | 0,20 | 10,00 |
Supuestos del agente: prompt de sistema + herramientas + catálogo resumido de ~5.000 tokens (cacheado), 5 llamadas al modelo por conversación (dos para herramientas) y respuestas de ~150 tokens. Para Sonnet 5.5 sumé un 30 % de tokens, porque su tokenizer produce más tokens para el mismo texto.
La arquitectura híbrida
En lugar de mandar todo al mismo modelo, un grafo de agente (LangGraph o el orquestador que tengas) usa a Jev como primer filtro y deriva cada caso al modelo más barato que lo resuelve bien:
Además de bajar tokens, baja mensajes: una pregunta frecuente se resuelve en 2 mensajes, no en 3. Con esa mezcla, el promedio queda en 2,6 mensajes por conversación.
| Arquitectura | LLM por conversación | LLM al mes (9.000 conversaciones) |
|---|---|---|
| Solo GPT-5-mini | USD 0,0019 | USD 17 |
| Solo GPT-5.4-mini | USD 0,0049 | USD 44 |
| Solo Claude Haiku 4.5 | USD 0,0064 | USD 58 |
| Solo Claude Sonnet 5.5 | USD 0,0166 | USD 150 |
| Híbrido (Jev + GPT-5.4-nano + GPT-5-mini + Sonnet 5.5) | USD 0,0026 | USD 23 |
Jev cuesta menos de una centésima de centavo por conversación: clasificar es prácticamente gratis.
El total: WhatsApp + tokens
Costo mensual con un número, restando los 1.000 mensajes gratis:
30 conversaciones por día (900/mes)
| País | Menú (12 msj) | Solo GPT-5-mini | Solo Haiku 4.5 | Solo Sonnet 5.5 | Híbrido |
|---|---|---|---|---|---|
| Perú | USD 294 | USD 53 | USD 57 | USD 66 | USD 43 |
| Argentina | USD 255 | USD 46 | USD 50 | USD 59 | USD 37 |
| Chile | USD 196 | USD 36 | USD 40 | USD 49 | USD 29 |
| México | USD 83 | USD 16 | USD 20 | USD 29 | USD 14 |
| Brasil | USD 67 | USD 13 | USD 17 | USD 27 | USD 11 |
| Colombia | USD 7,8 | USD 3,0 | USD 7,1 | USD 16 | USD 3,4 |
300 conversaciones por día (9.000/mes)
| País | Menú (12 msj) | Solo GPT-5-mini | Solo Haiku 4.5 | Solo Sonnet 5.5 | Híbrido |
|---|---|---|---|---|---|
| Perú | USD 3.210 | USD 797 | USD 838 | USD 930 | USD 695 |
| Argentina | USD 2.782 | USD 693 | USD 734 | USD 826 | USD 606 |
| Chile | USD 2.140 | USD 537 | USD 578 | USD 670 | USD 471 |
| México | USD 910 | USD 238 | USD 279 | USD 371 | USD 214 |
| Brasil | USD 728 | USD 194 | USD 234 | USD 327 | USD 176 |
| Colombia | USD 86 | USD 38 | USD 78 | USD 171 | USD 41 |
Lo que dicen las tablas:
- En los países caros, lo que mueve la factura son los mensajes, no los tokens. En Perú, pasar del menú a cualquier agente ahorra entre USD 2.280 y 2.515 al mes; entre el modelo más barato y el más caro hay apenas USD 235.
- El híbrido gana casi siempre, porque ahorra tokens y mensajes.
- En Colombia los tokens sí pesan. Un agente con Sonnet 5.5 para todo cuesta el doble que el menú; con GPT-5-mini o el híbrido, menos de la mitad.
La regla para decidir sigue siendo:
tarifa del país > costo de tokens por conversación / mensajes que ahorra
Contra un menú de 12 mensajes, el punto de equilibrio es de USD 0,0002 por mensaje con GPT-5-mini, 0,0003 con el híbrido, 0,0007 con Haiku 4.5 y 0,0019 con Sonnet 5.5. Colombia (0,0008) queda por encima de los tres primeros y por debajo de Sonnet: ahí el modelo que elijas decide si ahorras o pierdes.
Tres matices que cambian la conclusión
1. El rival real no es el menú: son las listas interactivas. WhatsApp tiene mensajes con listas y botones, y cada uno cuenta como un mensaje. Un bot bien hecho con listas resuelve el mismo caso en ~5 mensajes, sin IA. Contra eso, el agente ahorra solo 2 mensajes por conversación (2,4 el híbrido) y el equilibrio sube: ≈ USD 0,0009 con GPT-5-mini, 0,0011 con el híbrido, 0,0032 con Haiku 4.5 y 0,0083 con Sonnet 5.5. En Perú, Argentina y Chile cualquier agente sigue ganando; en México y Brasil conviene uno liviano o el híbrido; en Colombia gana el bot de listas. Antes de meter IA, pregúntate si tu problema no se resuelve con listas.
2. La arquitectura importa más que el modelo. Mandar todo a un modelo de frontera cuesta ~6 veces más en tokens que el híbrido, y los modelos más grandes (como Claude Opus o los GPT de razonamiento) no hacen falta para vender por WhatsApp: se reservan para lo que de verdad los necesita. Tres palancas: prompt caching (sin caché, el mismo agente cuesta ~5 veces más), un clasificador barato adelante (sobre Jev escribí en jev-la-ia-que-no-escribe-decide-el-primer-filtro-que-les-faltaba-a-los-agentes) y modelos pequeños por defecto. Dos advertencias: los modelos más pequeños se equivocan más al usar herramientas, así que evalúa cada ruta con conversaciones reales antes de confiarle ventas; y los números de Jev son los que publica TypeSafe. Como referencia, el agente propio de Meta (Meta Business Agent) se cobra aparte por tokens, ≈ 4–5 centavos por mensaje según Meta, y no es gratis ni dentro de la ventana de los anuncios.
3. Con anuncios Click-to-WhatsApp, WhatsApp cuesta cero. Dentro de esa ventana cualquier bot sale gratis, así que el agente es costo puro (≈ USD 2 al mes cada 900 conversaciones con el híbrido; ≈ USD 6 con Haiku 4.5). Ahí no se justifica por ahorro sino por conversión: si un agente vende más que un menú, se paga igual. Y medir eso bien implica cruzar anuncios, WhatsApp y ventas; es el tipo de hueco que describí en tres-mcps-y-una-ia-los-huecos-que-ningun-dashboard-te-muestra.
Qué haría esta semana
- Agrega el método de pago en tu cuenta de la API antes del 30/09.
- Cuenta mensajes por atención, no conversaciones. Ese número es el que se vuelve factura en octubre. Los webhooks ya marcan cada mensaje como
billabley con sucategory. - Junta mensajes. Nada de "Hola 👋" + "¿Cómo estás?" + "Estos son los precios" por separado, ni "dame un segundo que lo busco" antes de la respuesta: son tres cobros donde alcanza uno.
- Revisa los automatismos silenciosos: recordatorios de inactividad, "¿sigues ahí?", encuestas de dos pasos, despedidas automáticas. Si nadie responde, son costo sin retorno.
- Reemplaza árboles de menús por listas o botones antes de pensar en IA.
- Si usas un agente, haz la cuenta con la tarifa del país de tus clientes, con caché activada, un clasificador adelante y un modelo pequeño por defecto.
- Prueba tráfico desde anuncios Click-to-WhatsApp y compara la conversión contra tu landing: si convierte parecido, te ahorras los mensajes.
Lo importante
Que WhatsApp cobre por mensaje no mata a los bots: castiga a los bots verbosos. La métrica que importa pasa a ser mensajes por objetivo resuelto. Un agente de IA bien diseñado la baja mucho, y combinando modelos (un clasificador barato, un modelo pequeño para lo simple y uno grande solo para lo complejo) el costo en tokens es casi anecdótico frente al de WhatsApp. En Perú o Chile ahorra miles de dólares al mes; en Colombia, el modelo que elijas decide si ahorras o pierdes. Haz la cuenta con tus números antes de elegir.
Fuentes oficiales
- Meta — Pricing de la plataforma de WhatsApp Business
- Meta — Pricing de mensajes de servicio (no plantillas)
- Meta — Coexistencia: app WhatsApp Business + Cloud API
- Meta — Cambios en los límites de mensajería de la API
- Meta Newsroom — Meta One
- WhatsApp FAQ — Meta One para negocios
- WhatsApp FAQ — Difusiones pagas en la app Business
- Anthropic — Precios de la API
- OpenAI — Precios de la API
- TypeSafe — Jev
- Secundaria: TechCrunch — prueba de límites a mensajes sin respuesta (2025)
