---
title: "WhatsApp cobra por mensaje desde el 1 de octubre: por qué tu chatbot de menús se volvió caro (y cuándo un agente de IA sale más barato)"
description: "Desde el 1/10/2026 la API de WhatsApp cobra cada mensaje de servicio entregado. Contrasté lo que circula en videos con la documentación oficial de Meta y armé un modelo de costos: un bot de menús de 12 mensajes contra agentes de IA con modelos de OpenAI y Anthropic, solos o combinados con Jev como clasificador, en Perú, Argentina, Chile, México, Brasil y Colombia. Dónde el agente ahorra miles de dólares, dónde no conviene y por qué el rival real son las listas interactivas."
url: https://gabrielherencia.com/insights/whatsapp-cobra-por-mensaje-chatbot-de-menus-vs-agente-ia
author: "Gabriel Herencia"
published: 2026-09-29
updated: 2026-09-29
category: "Automatización"
tags: ["IA", "Automatización", "Toma de decisiones", "Agentes de IA", "Costos", "WhatsApp"]
reading_time_min: 12
---

# WhatsApp cobra por mensaje desde el 1 de octubre: por qué tu chatbot de menús se volvió caro (y cuándo un agente de IA sale más barato)

> Desde el 1/10/2026 la API de WhatsApp cobra cada mensaje de servicio entregado. Contrasté lo que circula en videos con la documentación oficial de Meta y armé un modelo de costos: un bot de menús de 12 mensajes contra agentes de IA con modelos de OpenAI y Anthropic, solos o combinados con Jev como clasificador, en Perú, Argentina, Chile, México, Brasil y Colombia. Dónde el agente ahorra miles de dólares, dónde no conviene y por qué el rival real son las listas interactivas.

![Portada: WhatsApp cobra por mensaje desde el 1 de octubre: por qué tu chatbot de menús se volvió caro (y cuándo un agente de IA sale más barato)](https://img.gabrielherencia.com/covers/whatsapp-cobra-por-mensaje-chatbot-de-menus-vs-agente-ia-d0d04417.jpg)

Desde el **1 de octubre de 2026** la API de WhatsApp (Cloud API) cobra **cada mensaje de servicio entregado**: las respuestas libres dentro de la ventana de 24 horas, que eran gratis desde noviembre de 2024. En redes circulan videos y webinars con datos a medias, así que fui a la documentación oficial de Meta, contrasté cada afirmación y armé un modelo de costos para responder la pregunta que me importa como alguien que construye agentes de WhatsApp: **¿un chatbot de menús sigue teniendo sentido cuando cada "volver al menú" se cobra?**

> Datos verificados el 29/09/2026 contra las páginas de pricing de Meta (actualizadas el 28/09/2026). Las tarifas cambian por trimestre: revísalas antes de decidir.

## Primero, separemos los dos WhatsApp

Casi toda la confusión viene de mezclar dos productos distintos:

| | **App WhatsApp Business** (el celular) | **WhatsApp Cloud API** (plataformas, CRMs, bots) |
|---|---|---|
| ¿Cambia el 1/10? | No hay cobro nuevo por responder | Sí: se cobra cada mensaje de servicio entregado |
| Responder a mano | Gratis | — |
| Qué se paga | Difusiones (*broadcasts*), paquetes de mensajes, suscripción Meta One | Mensajes salientes entregados |
| Escala | Pensada para pocos chats | Miles de conversaciones simultáneas |

Si respondes a mano desde el celular, **el cobro del 1 de octubre no te toca**. Si tienes un bot, un CRM o una IA conectada por API, sí. Con *coexistencia* (el mismo número en la app y en la API) se paga solo lo que sale por la API; lo que envías desde el celular sigue gratis.

## Lo que cambia en la API, según Meta

- **Mensajes de servicio pagos** desde el 1/10: cualquier mensaje que no sea plantilla (texto, audio, imagen, lista, botones) cuenta como uno. Se cobra el **entregado**, no el enviado.
- **Capa gratuita: 1.000 mensajes de servicio por mes, por número** (no por empresa). No se acumulan, se reinician cada mes y no cubren plantillas.
- **Tarifa = la de utilidad del país del *destinatario*.** No importa dónde esté tu empresa ni de qué país sea tu número.
- **Sin descuentos por volumen** para mensajes de servicio.
- **Las plantillas de utilidad dentro de la ventana de 24 h también pasan a cobrarse** (eran gratis desde julio de 2025).
- **Los mensajes que te manda el cliente son gratis.** Siempre.
- **Método de pago antes del 30/09.** Las páginas de Meta no son del todo consistentes sobre qué pasa si no lo tienes (una dice que se cortan los mensajes de servicio; otra, que se cortan al superar los 1.000 gratis). No lo averigües en producción: agrégalo ya.

### Tarifas por mensaje (USD, vigentes desde el 1/10/2026)

| País | Servicio = Utilidad | Marketing |
|---|---|---|
| Perú | 0,0300 | 0,0703 |
| Argentina | 0,0260 | 0,0618 |
| Chile | 0,0200 | 0,0889 |
| México | 0,0085 | 0,0397 |
| Brasil | 0,0068 | 0,0625 |
| Colombia | 0,0008 | 0,0125 |

Perú cuesta **37 veces** lo que Colombia por el mismo mensaje. Si vendes a varios países, tu costo depende de dónde están tus clientes.

## Lo que circula y no es tan así

- **"La ventana gratis de los anuncios dura 72 horas."** Hoy la documentación de Meta dice que la ventana de *Free Entry Point* (conversación que nace de un anuncio *Click-to-WhatsApp*) puede quedar abierta **hasta 7 días**, y que dentro de ella todo es gratis, incluidas plantillas de marketing. Condición: responder dentro de las primeras 24 h. Ojo: aplica a anuncios abiertos desde la app móvil; lo del botón de Instagram no lo encontré confirmado.
- **"WhatsApp Business limita a 250 chats nuevos por mes."** No hay ninguna página oficial con ese número para la app. Lo que sí existe: Meta confirmó en 2025 que *probaba* límites mensuales a mensajes **sin respuesta** (si la persona contesta, no cuenta), sin publicar cifras ni países. Por eso circulan capturas con "76 de 150" y otras con números distintos. El "250" parece venir de otro lado: es el límite inicial de la **API**, y es por **24 horas**, no por mes.
- **"Meta One te sube el límite de mensajes."** Meta One existe (desde USD 14,99 hasta USD 499/mes en planes para negocios: verificación, más dispositivos, página propia, créditos de difusión y de IA), pero ninguna página oficial dice que aumente el límite para iniciar chats. Y la insignia de verificado depende de que Meta verifique tu negocio: pagar no la garantiza.
- **"Si mando audio en vez de texto no me cobran."** Se cobra por mensaje entregado, sea del tipo que sea.

El consejo de fondo de esos videos sí es correcto: **no insistas a quien no responde.** Sube tu riesgo de reportes y bloqueos, y ahora además cuesta.

## Mi tesis: el chatbot de menús es el que más sufre

Un bot de opciones clásico ("marca 1 para ventas, 2 para soporte") está diseñado para un mundo donde el mensaje saliente era gratis. Cada paso del árbol es un mensaje:

1. Bienvenida
2. Menú principal
3. Submenú
4. "Opción inválida" (el cliente escribió texto libre, como hace todo el mundo)
5. Submenú otra vez
6. Lista de productos
7. Detalle y precio
8. Stock
9. Menú principal de nuevo (el cliente marcó "0 para volver")
10. "Ingresa el código del producto"
11. Link de pago
12. Despedida

**12 mensajes cobrados** para responder "¿cuánto sale y tienen stock?". El **retroceso entre opciones** es lo peor: cada "volver" reenvía menú y submenú. En Perú, un solo retroceso por conversación a 300 conversaciones por día son **USD 540 al mes** solo en idas y vueltas.

Un agente de IA entiende texto libre y resuelve lo mismo en **3 mensajes**: precio + stock + una pregunta consolidada; link de pago con resumen; cierre. Pero agrega un costo que el menú no tiene: **tokens**.

## El cálculo: WhatsApp vs tokens, con varios modelos

Un agente no tiene por qué ser un solo modelo. Precios oficiales al 29/09/2026 (USD por millón de tokens):

| Modelo | Para qué lo usaría en el agente | Entrada | Entrada en caché | Salida |
|---|---|---|---|---|
| **Jev** (TypeSafe) | Clasificar y enrutar: intención, urgencia, ¿necesita humano? | 0,042 | — | gratis |
| **GPT-5.4-nano** (OpenAI) | Preguntas frecuentes y respuestas simples | 0,20 | 0,02 | 1,25 |
| **GPT-5-mini** (OpenAI) | Flujo transaccional con herramientas | 0,25 | 0,025 | 2,00 |
| **GPT-5.4-mini** (OpenAI) | Lo mismo, con más capacidad | 0,75 | 0,075 | 4,50 |
| **Claude Haiku 4.5** (Anthropic) | Flujo transaccional con herramientas | 1,00 | 0,10 | 5,00 |
| **Claude Sonnet 5.5** (Anthropic) | Casos complejos: reclamos, negociación, excepciones | 2,00 | 0,20 | 10,00 |

Supuestos del agente: *prompt* de sistema + herramientas + catálogo resumido de ~5.000 tokens (cacheado), 5 llamadas al modelo por conversación (dos para herramientas) y respuestas de ~150 tokens. Para Sonnet 5.5 sumé un 30 % de tokens, porque su *tokenizer* produce más tokens para el mismo texto.

### La arquitectura híbrida

En lugar de mandar todo al mismo modelo, un grafo de agente (LangGraph o el orquestador que tengas) usa a Jev como primer filtro y deriva cada caso al modelo más barato que lo resuelve bien:

```mermaid
flowchart LR
    M["Mensaje entrante"] --> J{{"Jev<br/>intención · urgencia<br/>¿necesita humano?"}}
    J -->|"~50 % pregunta frecuente"| N["GPT-5.4-nano<br/>1 respuesta"]
    J -->|"~40 % precio, stock, pago"| T["GPT-5-mini + herramientas<br/>catálogo · link de pago"]
    J -->|"~10 % reclamo o excepción"| S["Claude Sonnet 5.5"]
    J -->|"baja confianza"| H["Persona"]
```

Además de bajar tokens, baja mensajes: una pregunta frecuente se resuelve en 2 mensajes, no en 3. Con esa mezcla, el promedio queda en **2,6 mensajes por conversación**.

| Arquitectura | LLM por conversación | LLM al mes (9.000 conversaciones) |
|---|---|---|
| Solo GPT-5-mini | USD 0,0019 | USD 17 |
| Solo GPT-5.4-mini | USD 0,0049 | USD 44 |
| Solo Claude Haiku 4.5 | USD 0,0064 | USD 58 |
| Solo Claude Sonnet 5.5 | USD 0,0166 | USD 150 |
| **Híbrido** (Jev + GPT-5.4-nano + GPT-5-mini + Sonnet 5.5) | **USD 0,0026** | **USD 23** |

Jev cuesta menos de una centésima de centavo por conversación: clasificar es prácticamente gratis.

### El total: WhatsApp + tokens

Costo mensual con **un número**, restando los 1.000 mensajes gratis:

**30 conversaciones por día (900/mes)**

| País | Menú (12 msj) | Solo GPT-5-mini | Solo Haiku 4.5 | Solo Sonnet 5.5 | Híbrido |
|---|---|---|---|---|---|
| Perú | USD 294 | USD 53 | USD 57 | USD 66 | **USD 43** |
| Argentina | USD 255 | USD 46 | USD 50 | USD 59 | **USD 37** |
| Chile | USD 196 | USD 36 | USD 40 | USD 49 | **USD 29** |
| México | USD 83 | USD 16 | USD 20 | USD 29 | **USD 14** |
| Brasil | USD 67 | USD 13 | USD 17 | USD 27 | **USD 11** |
| Colombia | USD 7,8 | **USD 3,0** | USD 7,1 | USD 16 | USD 3,4 |

**300 conversaciones por día (9.000/mes)**

| País | Menú (12 msj) | Solo GPT-5-mini | Solo Haiku 4.5 | Solo Sonnet 5.5 | Híbrido |
|---|---|---|---|---|---|
| Perú | USD 3.210 | USD 797 | USD 838 | USD 930 | **USD 695** |
| Argentina | USD 2.782 | USD 693 | USD 734 | USD 826 | **USD 606** |
| Chile | USD 2.140 | USD 537 | USD 578 | USD 670 | **USD 471** |
| México | USD 910 | USD 238 | USD 279 | USD 371 | **USD 214** |
| Brasil | USD 728 | USD 194 | USD 234 | USD 327 | **USD 176** |
| Colombia | USD 86 | **USD 38** | USD 78 | USD 171 | USD 41 |

Lo que dicen las tablas:

- **En los países caros, lo que mueve la factura son los mensajes, no los tokens.** En Perú, pasar del menú a cualquier agente ahorra entre USD 2.280 y 2.515 al mes; entre el modelo más barato y el más caro hay apenas USD 235.
- **El híbrido gana casi siempre**, porque ahorra tokens *y* mensajes.
- **En Colombia los tokens sí pesan.** Un agente con Sonnet 5.5 para todo cuesta el doble que el menú; con GPT-5-mini o el híbrido, menos de la mitad.

La regla para decidir sigue siendo:

```
tarifa del país  >  costo de tokens por conversación / mensajes que ahorra
```

Contra un menú de 12 mensajes, el punto de equilibrio es de **USD 0,0002** por mensaje con GPT-5-mini, **0,0003** con el híbrido, **0,0007** con Haiku 4.5 y **0,0019** con Sonnet 5.5. Colombia (0,0008) queda por encima de los tres primeros y por debajo de Sonnet: ahí el modelo que elijas decide si ahorras o pierdes.

## Tres matices que cambian la conclusión

**1. El rival real no es el menú: son las listas interactivas.** WhatsApp tiene mensajes con listas y botones, y cada uno cuenta como **un** mensaje. Un bot bien hecho con listas resuelve el mismo caso en ~5 mensajes, sin IA. Contra eso, el agente ahorra solo 2 mensajes por conversación (2,4 el híbrido) y el equilibrio sube: **≈ USD 0,0009** con GPT-5-mini, **0,0011** con el híbrido, **0,0032** con Haiku 4.5 y **0,0083** con Sonnet 5.5. En Perú, Argentina y Chile cualquier agente sigue ganando; en México y Brasil conviene uno liviano o el híbrido; en Colombia gana el bot de listas. Antes de meter IA, pregúntate si tu problema no se resuelve con listas.

**2. La arquitectura importa más que el modelo.** Mandar todo a un modelo de frontera cuesta ~6 veces más en tokens que el híbrido, y los modelos más grandes (como Claude Opus o los GPT de razonamiento) no hacen falta para vender por WhatsApp: se reservan para lo que de verdad los necesita. Tres palancas: *prompt caching* (sin caché, el mismo agente cuesta ~5 veces más), un clasificador barato adelante (sobre Jev escribí en [jev-la-ia-que-no-escribe-decide-el-primer-filtro-que-les-faltaba-a-los-agentes](https://gabrielherencia.com/insights/jev-la-ia-que-no-escribe-decide-el-primer-filtro-que-les-faltaba-a-los-agentes)) y modelos pequeños por defecto. Dos advertencias: los modelos más pequeños se equivocan más al usar herramientas, así que evalúa cada ruta con conversaciones reales antes de confiarle ventas; y los números de Jev son los que publica TypeSafe. Como referencia, el agente propio de Meta (*Meta Business Agent*) se cobra aparte por tokens, ≈ 4–5 centavos por mensaje según Meta, y **no** es gratis ni dentro de la ventana de los anuncios.

**3. Con anuncios Click-to-WhatsApp, WhatsApp cuesta cero.** Dentro de esa ventana cualquier bot sale gratis, así que el agente es costo puro (≈ USD 2 al mes cada 900 conversaciones con el híbrido; ≈ USD 6 con Haiku 4.5). Ahí no se justifica por ahorro sino por **conversión**: si un agente vende más que un menú, se paga igual. Y medir eso bien implica cruzar anuncios, WhatsApp y ventas; es el tipo de hueco que describí en [tres-mcps-y-una-ia-los-huecos-que-ningun-dashboard-te-muestra](https://gabrielherencia.com/insights/tres-mcps-y-una-ia-los-huecos-que-ningun-dashboard-te-muestra).

## Qué haría esta semana

1. **Agrega el método de pago** en tu cuenta de la API antes del 30/09.
2. **Cuenta mensajes por atención, no conversaciones.** Ese número es el que se vuelve factura en octubre. Los webhooks ya marcan cada mensaje como `billable` y con su `category`.
3. **Junta mensajes.** Nada de "Hola 👋" + "¿Cómo estás?" + "Estos son los precios" por separado, ni "dame un segundo que lo busco" antes de la respuesta: son tres cobros donde alcanza uno.
4. **Revisa los automatismos silenciosos**: recordatorios de inactividad, "¿sigues ahí?", encuestas de dos pasos, despedidas automáticas. Si nadie responde, son costo sin retorno.
5. **Reemplaza árboles de menús por listas o botones** antes de pensar en IA.
6. **Si usas un agente, haz la cuenta con la tarifa del país de tus clientes**, con caché activada, un clasificador adelante y un modelo pequeño por defecto.
7. **Prueba tráfico desde anuncios Click-to-WhatsApp** y compara la conversión contra tu landing: si convierte parecido, te ahorras los mensajes.

## Lo importante

Que WhatsApp cobre por mensaje no mata a los bots: castiga a los **bots verbosos**. La métrica que importa pasa a ser **mensajes por objetivo resuelto**. Un agente de IA bien diseñado la baja mucho, y combinando modelos (un clasificador barato, un modelo pequeño para lo simple y uno grande solo para lo complejo) el costo en tokens es casi anecdótico frente al de WhatsApp. En Perú o Chile ahorra miles de dólares al mes; en Colombia, el modelo que elijas decide si ahorras o pierdes. Haz la cuenta con tus números antes de elegir.

---

**Fuentes oficiales**

- [Meta — Pricing de la plataforma de WhatsApp Business](https://developers.facebook.com/documentation/business-messaging/whatsapp/pricing)
- [Meta — Pricing de mensajes de servicio (no plantillas)](https://developers.facebook.com/documentation/business-messaging/whatsapp/pricing/non-template-messages)
- [Meta — Coexistencia: app WhatsApp Business + Cloud API](https://developers.facebook.com/documentation/business-messaging/whatsapp/embedded-signup/onboarding-business-app-users)
- [Meta — Cambios en los límites de mensajería de la API](https://developers.facebook.com/documentation/business-messaging/whatsapp/upcoming-messaging-limits-changes/)
- [Meta Newsroom — Meta One](https://about.fb.com/news/2026/09/introducing-meta-one-subscription-service-more-features-ai/)
- [WhatsApp FAQ — Meta One para negocios](https://faq.whatsapp.com/975910528178219)
- [WhatsApp FAQ — Difusiones pagas en la app Business](https://faq.whatsapp.com/1711086883148106)
- [Anthropic — Precios de la API](https://platform.claude.com/docs/en/about-claude/pricing)
- [OpenAI — Precios de la API](https://developers.openai.com/api/docs/pricing)
- [TypeSafe — Jev](https://typesafe.ai/)
- Secundaria: [TechCrunch — prueba de límites a mensajes sin respuesta (2025)](https://techcrunch.com/2025/10/17/whatsapp-will-curb-the-number-of-messages-people-and-businesses-can-send-without-a-response)
