"¿Cuánto cuesta poner una IA atendiendo mi WhatsApp?" Es la primera pregunta de casi todo cliente — y la respuesta honesta es: depende, pero se puede estimar bien. Quien te da un número redondo sin preguntar nada está adivinando o escondiendo costo. Voy a abrir la cuenta de verdad, capa por capa, para que presupuestes sin caer en trampas.
El costo tiene tres capas — y son diferentes
Mucha gente piensa en el "costo de IA" como una sola cosa. Son tres, con comportamientos distintos:
- La plataforma (WhatsApp Business API): lo que Meta cobra para que el mensaje circule.
- El cerebro (LLM): lo que pagas para que la IA piense en cada mensaje.
- La construcción y la infraestructura: lo que cuesta hacer que el agente exista y se mantenga en pie.
Las dos primeras son costo variable (crecen con el uso). La tercera es mayoritariamente inversión inicial. Mezclar las tres es lo que genera presupuestos equivocados.
Capa 1 — WhatsApp Business API (por conversación)
La WABA no es gratuita de operar. La Cloud API de Meta es gratuita de hospedar, pero Meta cobra por las conversaciones/mensajes, con reglas que cambian el precio:
- Quién la inició: una conversación iniciada por el cliente (dentro de la ventana de 24h) frente a una iniciada por ti (template) tienen costos diferentes.
- Categoría del template: marketing, utility y authentication tienen precios distintos.
- País: el precio varía según la región.
Detallé esas reglas en la guía de la WhatsApp Business API. Lo importante para el presupuesto: este costo es por conversación y predecible. Si sabes cuántas conversaciones/mes esperas, sabes estimar esta capa.
Capa 2 — El LLM (por mensaje procesado)
Cada vez que el agente "piensa", consume tokens de un modelo de lenguaje, y eso tiene precio. El costo aquí depende de:
- Volumen: más mensajes = más llamadas = más costo.
- Tamaño del contexto: historiales largos y prompts gigantes cuestan más por llamada.
- El modelo elegido: los modelos de gama alta cuestan varias veces el precio de los modelos más pequeños.
Aquí está la mayor palanca de optimización. La mayoría de los mensajes son simples ("¿cuál es mi factura?") y no necesitan el modelo más caro. Un agente bien arquitecturado usa un modelo barato para lo simple y el caro solo cuando la conversación exige razonamiento — y corre con fallback entre proveedores. Esto puede reducir el costo de LLM en órdenes de magnitud sin perder calidad.
Capa 3 — Construcción e infraestructura
Esta es la que nadie pone en la planilla y después se asusta. Un agente que aguanta producción no es un script de fin de semana. Necesita:
- Integración real con tus sistemas (CRM, ERP, pasarela de pago) — las herramientas que hacen que el agente resuelva, no solo converse.
- Arquitectura resiliente: cola, idempotencia, fallback, observabilidad.
- Lógica de negocio, manejo de la ventana de 24h, human handoff.
Es aquí donde está el grueso de la inversión — y es lo que separa a un agente que genera resultados de un bot que frustra al cliente. Es inversión inicial, no costo recurrente: bien construido, corre barato y escala.
Si es por voz, suma una capa
Un agente de voz (call center de IA por teléfono) agrega transcripción (STT) y síntesis de habla (TTS), generalmente cobradas por minuto de audio. Esto hace que la operación de voz sea más cara por interacción que el texto — pero aún absurdamente más barata que un agente humano en la misma escala. La arquitectura de voz tiene sus propias exigencias.
Cómo presupuestar de verdad (el método honesto)
Antes de preguntar "cuánto cuesta", responde:
- Volumen: ¿cuántas conversaciones por mes? (define las capas 1 y 2)
- Canal: ¿texto (WhatsApp) o voz? (la voz suma STT/TTS)
- Complejidad: ¿el agente solo responde, o necesita integrarse con tus sistemas y actuar? (define la capa 3)
- Una pregunta comparativa: ¿cuánto cuesta hoy esa operación en horas de tu equipo humano?
Esta última pregunta es la que importa. Un agente de IA casi nunca se evalúa en el vacío — se evalúa contra el costo de hacer lo mismo con gente. Y es ahí donde la cuenta suele cerrar con holgura: lo repetitivo, que es la mayoría, sale por una fracción del costo humano, 24/7, sin fila.
La respuesta corta
No existe un precio de lista porque no existe un agente genérico. Pero la estructura es siempre esta: un costo variable por conversación (WABA + LLM) que la optimización mantiene bajo, más una inversión inicial de construcción que define si el agente resuelve o frustra. Huye de quien te da un número sin preguntar tu volumen y tus sistemas — y huye más aún de quien esconde la capa 3.
Hago el diagnóstico y te digo la cuenta real para tu caso — volumen, canal, integración. Si quieres presupuestar un agente de IA sin adivinar, escríbeme.