IA en WhatsApp Business API: costes por alternativa

Compatibilità
Salva(0)
Condividi

Índice: cuánto cuesta la IA en WhatsApp Business API

Los dos artículos anteriores de esta serie explicaban cuánto vas a pagar por cada mensaje y cómo diseñar mejor la conversación para necesitar menos. Este va de la pregunta que viene justo después: si cada respuesta tiene un coste, ¿quién o qué debería escribirla? Si aún no los has leído, empieza por el cambio de precios de WhatsApp Business API y por cómo reducir esa factura.

Cuánto cuesta la IA en WhatsApp Business API según quién responda

Desde el 1 de octubre de 2026, cada respuesta dentro de la ventana de 24 horas tiene un coste. Pero no cuesta lo mismo según quién la escriba. Si responde una persona, un bot o una IA de terceros, Meta cobra la misma tarifa de servicio por mensaje. Si responde el agente de IA de Meta, cobra por los tokens que consume ese mensaje, y no se suma la tarifa de servicio.

A eso hay que añadir lo que no aparece en la factura de Meta: las horas de tu equipo, el consumo del modelo de IA si es de terceros y lo que cuesta montar cada opción. Por eso la pregunta ya no es solo cuántos mensajes mandas, sino cuánto te cuesta de verdad cada forma de responder.

Qué es un token y qué lee la IA antes de responder

Los modelos de IA no leen palabras, leen tokens: pequeños fragmentos de texto de pocos caracteres. En español, una palabra suele ocupar uno o dos tokens, así que 1.000 tokens equivalen, de forma orientativa, a entre 600 y 750 palabras según el modelo.

Lo importante es qué lee la IA cada vez que responde. No lee solo el último mensaje del cliente: en cada turno vuelve a leer todo lo que necesita para contestar.

  • Instrucciones. Tono, reglas y qué puede hacer. Entre 500 y 2.000 tokens.
  • Conocimiento. Preguntas frecuentes, catálogo, precios o datos del CRM. De 500 a 20.000 tokens, según cómo esté organizado.
  • Acciones. Lo que puede ejecutar: crear una cita, consultar un pedido. Hasta 1.500 tokens.
  • Historial. Lo hablado hasta ahora. Crece con cada turno.
  • Mensaje del cliente. Lo que acaba de escribir: entre 20 y 60 tokens.
  • Respuesta. Lo que genera la IA: entre 80 y 200 tokens. Es lo único que escribe; todo lo demás lo lee.

Por eso, aunque los tokens de salida son más caros por unidad, la mayor parte de la factura es lectura. Una IA que lee 20.000 tokens para escribir 120 paga casi todo por lo que lee.

La IA escribe 120 tokens, pero lee más de 20.000 para escribirlos: casi toda la factura es lectura.

Las cuatro formas de responder en WhatsApp

Hay cuatro maneras de que un mensaje reciba respuesta, y se pueden combinar en el mismo número. Cada una tiene un perfil de coste distinto:

AlternativaQué paga a Meta por respuestaQué se paga aparteCuánto cuesta ponerla en marcha
PersonasTarifa de servicio (0,0166 € en España)Las horas del equipoOrganizar al equipo y la bandeja compartida
Bot sin IATarifa de servicioNada por respuesta, más allá de la licencia de la plataformaDiseñar, configurar y mantener el flujo
IA de tercerosTarifa de servicioLos tokens del proveedor de IA y, si la hay, la cuota del módulo de IA de la plataformaConfigurar el asistente, ordenar el conocimiento, integrarlo con el CRM y supervisarlo
Agente de IA de MetaSin tarifa de servicio: un único cargo por tokens (2 $ por millón)NadaCargar el conocimiento, configurar el agente y supervisarlo

Personas

Un agente del equipo lee, decide y responde. Es la opción más flexible y la única que maneja bien la ambigüedad, una negociación o una queja delicada. Su coste tiene dos partes: la tarifa de servicio de Meta por cada respuesta y el tiempo que dedica la persona. Con un supuesto de 2 minutos por respuesta y un coste de 22 € por hora, cada respuesta cuesta unos 0,73 € en tiempo, frente a los 0,0166 € de la tarifa de Meta.

Bot sin IA

Un flujo conversacional con botones, listas, WhatsApp Flows y respuestas fijas. Es la opción más barata por respuesta cuando la pregunta es predecible —horarios, ubicación, estado de un pedido—, porque no suma coste de IA a la tarifa de Meta. Su coste real está en el tiempo de diseñarlo, configurarlo y mantenerlo al día. Y se queda corto en cuanto la pregunta se sale del guion.

IA de terceros vía plataforma

Un modelo de IA de OpenAI, Google, Anthropic u otro proveedor, conectado a WhatsApp a través de tu plataforma —Woztell, Blip, Spoki u otra—. Aquí el coste llega en dos facturas: la tarifa de servicio de Meta, igual que en las opciones anteriores, y el consumo del modelo de IA. Ese consumo depende de cuántos tokens procese el modelo elegido, y eso depende a su vez de qué tareas tenga que hacer en cada respuesta.

Los precios varían mucho entre modelos. Un modelo ligero cuesta veinte veces menos que uno avanzado del mismo proveedor, y para atención al cliente el ligero suele bastar.

Agente de IA de Meta

El agente de IA propio de Meta, integrado en la plataforma de WhatsApp Business. Agrupa en un solo cargo la IA y la entrega: Meta cobra 2 $ por millón de tokens, sin tarifa de servicio y sin factura aparte de un proveedor de IA.

La contrapartida es el consumo. Según la propia Meta, un mensaje suele consumir entre 20.000 y 25.000 tokens, unos 4–5 céntimos de dólar (entre 3,5 y 4,4 céntimos de euro). Las respuestas sencillas consumen menos, pero incluso su ejemplo de pregunta simple ronda los 20.000 tokens por mensaje. Además, no eliges el modelo ni controlas qué lee la IA en cada turno, así que la decisión depende de cómo se comporte con tu caso concreto.

Dos excepciones que cambian las cuentas

Las primeras 1.000 respuestas de servicio son gratis cada mes por número de teléfono. Por debajo de ese volumen, una persona, un bot o una IA de terceros no pagan nada a Meta por responder. El agente de Meta, en cambio, cobra por tokens desde el primer mensaje.

La segunda es la ventana de 72 horas de Click-to-WhatsApp: cuando el cliente llega desde un anuncio y respondes en 24 horas, la entrega de mensajes es gratis durante 72 horas. Pero Meta aclara que los mensajes de su agente se siguen cobrando por tokens dentro de esa ventana. Si buena parte de tu tráfico llega por anuncios, la balanza se inclina hacia las otras tres opciones. Lo explicamos en el punto 6 de cómo reducir el coste de WhatsApp Business API.

En las dos excepciones, el agente de Meta sigue cobrando por tokens.

Cinco casos: cuánto cuestan 1.000 respuestas

Para comparar, hemos calculado cinco casos ilustrativos, con negocios y conversaciones ficticios pero con tarifas reales consultadas el 23 de septiembre. Todas las cifras son por cada 1.000 respuestas a partir de la respuesta 1.001 del mes, en euros y sin IVA.

CasoQué haceTokens que lee por respuestaIA ligera + servicioIA avanzada + servicioAgente de Meta
1. Clínica SonrisaPreguntas frecuentes sobre citas y precios, conversaciones cortas1.65016,79 €20,36 €35–44 €
2. Tienda LúaCatálogo, datos del cliente en el CRM y devoluciones9.25017,47 €34,09 €35–44 €
3. Fisio NorteTodo el conocimiento cargado en cada turno20.94018,48 €54,28 €35–44 €
CasoCómo respondeCoste por 1.000 respuestas
4. Hotel Mar AzulBot sin IA: menús, botones y Flows16,60 € (solo tarifa de servicio)
5. Asesoría VegaResponde una persona (supuesto: 2 minutos por respuesta a 22 €/hora)≈ 750 € (733 € de tiempo + 16,60 € de servicio)
Con una IA ligera, la diferencia entre opciones es pequeña; lo que dispara el coste es la IA avanzada con demasiado contexto o la respuesta humana.

Con una IA ligera, casi todo es tarifa de Meta: de los 16,79 € de la clínica, 16,60 € son mensajes de servicio y apenas 0,19 € son tokens. El modelo y la configuración empiezan a pesar cuando se usa una IA avanzada o cuando el asistente lee demasiado, como en el caso 3.

Y la diferencia grande no está entre las opciones automáticas, sino frente a la persona: una respuesta humana cuesta entre 14 y 45 veces más que cualquiera de las automáticas. El ahorro de automatizar no está en los tokens: está en las horas que libera para lo que de verdad necesita a una persona.

Cómo lo hemos calculado:

  • IA ligera: GPT-6 Luna de OpenAI (0,10 $ por millón de tokens de entrada y 0,50 $ de salida).
  • IA avanzada: GPT-6 Sol (2 $ y 10 $)
  • Agente de Meta: la referencia de consumo que publica Meta, de 20.000 a 25.000 tokens por mensaje a 2 $ por millón, porque su consumo no depende de cómo configures el asistente. Tarifa de servicio en España: 0,0166 €.

Cambio: 1 € = 1,14 $. Los precios cambian varias veces al año: compruébalos antes de decidir.

Depende del caso, y no es blanco o negro. Dos ejemplos de la tabla:

  • Meta sale más caro. En la clínica, una IA ligera de terceros cuesta 16,79 € por cada 1.000 respuestas, tarifa de servicio incluida. El agente de Meta, entre 35 y 44 €: más del doble.
  • Meta sale más barato. En Fisio Norte, con todo el conocimiento cargado y una IA avanzada, la opción de terceros sube a 54,28 €. Ahí, los 35–44 € del agente de Meta son la opción más económica.

La propia Meta llega a una conclusión parecida en su comparativa: una IA de terceros sencilla sale más barata que su agente, y una compleja, más cara. A favor de terceros juegan también las 1.000 respuestas gratuitas por número y la ventana de 72 horas de los anuncios. A favor de Meta, que es un solo proveedor y una sola factura.

Y el precio no debería ser lo único que decida. Pesan tanto o más otras cuestiones: la calidad de las respuestas, la integración con tu CRM, el control sobre lo que dice el bot y cómo pasa la conversación a una persona.

Cómo se abarata una IA de terceros: el ejemplo de Fisio Norte

Volvamos al caso 3. Es un ejemplo ilustrativo, pero es un patrón muy habitual en asistentes montados deprisa. Un cliente pregunta: «¿Cuánto cuesta una sesión?». Así cambia lo que la IA tiene que leer para responder a la misma pregunta, según cómo esté configurada:

Antes · 20.940 tokens de entradaDespués de optimizar · 4.140 tokens de entrada
Instrucciones2.000 tokens: el manual completo del asistente, con dos páginas de ejemplos, en cada turno900 tokens: solo cómo responder; los ejemplos viven en un documento aparte
Conocimiento18.000 tokens: toda la base, con tratamientos, precios, seguros, horarios, los 3 centros y los 9 fisios2.500 tokens: base de conocimiento troceada; solo viajan los 3 fragmentos que pide la pregunta (sesiones, bonos y seguros)
Acciones500 tokens: las 8 acciones disponibles, aunque la pregunta sea de precios300 tokens: solo «pedir cita» y «pasar a persona»

La respuesta que recibe el cliente es la misma. Lo que cambia es lo que la IA lee para escribirla: cinco veces menos. Estas son las palancas:

  • Recuperar solo lo relevante. La técnica se llama RAG (Retrieval-Augmented Generation, generación aumentada por recuperación): el conocimiento se trocea en fragmentos y en cada pregunta solo viajan los que hacen falta. Es la palanca con más impacto.
  • Instrucciones cortas. Reglas concisas, y los ejemplos largos fuera del mensaje principal.
  • Acciones según la intención. Si la pregunta es de precios, la IA no necesita evaluar las ocho acciones que sabe ejecutar.
  • Caché de entrada. Los proveedores cobran mucho menos por la parte fija que se repite en cada turno si se marca como caché.
  • Menos turnos. Botones y WhatsApp Flows acortan la conversación, y con ella el historial que se relee. Lo contamos en cómo reducir el coste de WhatsApp Business API.
  • Respuestas cortas. Dos o tres frases, sin repetir la pregunta: la salida es el token más caro.

La tabla recoge los tres primeros ajustes, que dejan la lectura en 4.140 tokens. Si además se acortan la conversación y las respuestas, se llega a 3.935. Este es el ahorro de cada palanca:

Trocear el conocimiento ahorra 15.500 de los 17.005 tokens: es, con diferencia, la palanca que más ahorra.

El efecto depende del modelo. Con una IA avanzada, el coste baja a menos de la mitad:

Recapiti
Nestor Tejero Bermejo