Guía9 min

Agente de WhatsApp con IA: arquitectura, costos y límites reales

TL;DR

Arquitectura completa para poner un agente de IA en WhatsApp: cómo funciona la Cloud API de Meta, webhooks y verificación, cuándo conviene Twilio u otro proveedor en vez de la integración directa, precios por mensaje y plantillas aprobadas, límites de la ventana de 24 horas y por qué Telegram es la alternativa más barata para validar tu agente.

WhatsApp
Teléfono móvil con una conversación de chat y detrás un diagrama de arquitectura con webhook y servidor

Por qué importa

Esta nota se enfoca en la decisión práctica para builders: qué cambia, qué riesgo agrega y cómo aplicarlo sin romper operación.

Poner un agente de IA en WhatsApp es la petición más común de cualquier negocio que ya vive en el chat. También es la más subestimada: WhatsApp no es un canal abierto como Telegram, sino una plataforma comercial con reglas de mensajería, plantillas aprobadas y un precio por mensaje que depende del país del cliente. Esta guía te da la arquitectura real —Cloud API directo vs proveedores como Twilio o 360dialog—, los costos por conversación, los límites de plantillas y la alternativa honesta: empezar en Telegram.

Cómo funciona WhatsApp Business Platform

La pieza central es la Cloud API de Meta: un API HTTP que recibe y envía mensajes de WhatsApp. Cuando un cliente escribe a tu número, Meta hace una petición HTTP a tu servidor (webhook). Tu servidor procesa el mensaje —aquí entra tu agente de IA— y responde llamando al API con el mensaje de salida.

La arquitectura mínima de un agente:

  1. Número de WhatsApp conectado a un Meta Business Account.
  2. Webhook propio (endpoint HTTPS público) donde Meta envía los mensajes entrantes.
  3. Capa de agente: modelo de lenguaje + herramientas, que decide la respuesta.
  4. Llamada de salida al Cloud API con el texto o plantilla a enviar.

Diagrama de arquitectura del agente de WhatsApp: cliente, Cloud API, webhook, agente y respuesta

La verificación del webhook es el paso que más falla en la primera hora: Meta te pide un token de verificación que tu endpoint debe devolver tal cual en el primer handshake. Después de eso, cada mensaje entrante llega con un payload JSON que incluye el texto, el número del remitente y el ID del mensaje. Tu servidor debe responder 200 rápido y procesar en segundo plano, o Meta reintentará el envío y duplicará trabajo.

Cloud API directo vs proveedores

CriterioMeta Cloud API directoTwilio / 360dialog (BSP)
PrecioTarifa por mensaje de MetaTarifa de Meta + margen del proveedor
SetupApp en Meta for Developers, verificación de negocioCuenta del proveedor, suelen acelerar onboarding
Soporte técnicoComunidad y docs; sin soporte directo en planes gratisSoporte del proveedor, SLAs en planes pagos
ControlTotal: datos y webhooks directosPasan por la infraestructura del proveedor
Para quiénDesarrolladores con tiempo de integraciónEquipos que necesitan soporte y velocidad

Los proveedores no eliminan el costo de Meta: lo agregan. La pregunta no es "¿Twilio o Meta?" sino "¿cuánto vale tu tiempo de integración y tu necesidad de soporte?". Para un MVP con criterio técnico propio, el Cloud API directo alcanza; para operaciones serias con SLAs, un BSP se paga solo.

Costos reales por conversación

Meta cobra por mensaje entregado, no por conversación como antes. Dos reglas que definen tu presupuesto:

  • Mensajes iniciados por el cliente (sesión de 24 horas): los mensajes de respuesta gratuitos dentro de la ventana no se cobran; los que salen de plantilla sí.
  • Mensajes iniciados por tu negocio: siempre usan una plantilla aprobada (utilidad, marketing, autenticación o servicio) y se cobran según la categoría y el código de país del destinatario.

El precio varía por país y categoría: una plantilla de utilidad cuesta menos que una de marketing, y el mismo mensaje cuesta distinto en Estados Unidos que en América Latina. La documentación de precios de Meta publica las tablas por código de país; antes de estimar tu agente, busca el país de tus clientes y multiplica por la cantidad de mensajes de plantilla que enviarás al mes.

A esto súmale los tokens del modelo (la conversación con tu agente), el hosting de tu webhook y, si usas BSP, el margen del proveedor. La fórmula de costo mensual:

Costo = (plantillas entregadas × tarifa del país) + tokens del modelo + hosting

Para un agente de soporte que solo responde dentro de la ventana de 24 horas, el costo por mensaje puede ser casi cero. Para campañas proactivas, el costo lo domina la tarifa de plantillas de marketing.

Límites de plantillas y reglas de producto

  • Aprobación previa: cada plantilla proactiva pasa por revisión de Meta; cambios de copy requieren nueva aprobación.
  • Ventana de sesión: una vez que el cliente escribe, tienes 24 horas de conversación libre de plantillas.
  • Calidad del número: reportes de usuarios o mensajes marcados bajan tu límite de mensajes por día.
  • No hay spam: enviar sin opt-in o con contenido engañoso es la vía rápida a un bloqueo de número.

Para un agente con IA, la consecuencia práctica: el agente debe responder dentro de la ventana de 24 horas y nunca iniciar conversación sin plantilla aprobada. Tu prompt y tus herramientas deben asumir ese límite como una regla de negocio, no como un detalle técnico.

Alternativa para empezar: Telegram

Si el objetivo es validar el agente —no el canal—, Telegram es objetivamente más simple:

  • Bot API gratuito, sin aprobación de plantillas ni costo por mensaje.
  • El mismo webhook HTTPS, con verificación por token de tu parte.
  • Soporta botones, encuestas y archivos nativos, ideales para agentes ricos.
  • Migrar el backend después es directo: el agente (LLM + herramientas) no cambia, solo cambia el adaptador de mensajería.

Mapa visual de verificación de costos y límites para el agente de WhatsApp

La estrategia recomendada: construye el agente contra Telegram, valida que resuelve el problema con tus clientes reales, y solo entonces invierte en el onboarding de WhatsApp. El trabajo de arquitectura (agente, herramientas, memoria) se reutiliza casi completo, como explica la guía de despliegue de agentes en WhatsApp, Telegram y Slack. Y antes de elegir modelo o arquitectura, revisa la comparativa de costos y latencia de agentes de mensajería para no descubrir el precio cuando ya tienes tráfico.

Checklist para el día uno

  1. Crea el webhook y responde el token de verificación de Meta.
  2. Maneja el payload entrante con ID de mensaje único (idempotencia).
  3. Respeta la ventana de 24 horas: responde dentro de sesión.
  4. Usa plantillas aprobadas para todo mensaje proactivo.
  5. Estima el costo con la tabla de precios del país de tus clientes.
  6. Registra cada mensaje con traceId para auditar decisiones del agente.

WhatsApp te da el canal donde ya están tus clientes; el Cloud API te da el acceso; y tu agente es lo único que diferencia tu respuesta de la de un bot de menú. Construye el agente bien —con permisos, memoria y observabilidad— y el canal solo será un adaptador más. El hub de construcción de agentes tiene el resto del camino: arquitectura, herramientas y despliegue. Si estás arrancando desde cero, el curso gratuito te muestra cómo instalar y operar tu propio agente antes de atarte a un canal específico.