Cuánto cuesta un chatbot con IA para tu empresa: el desglose real de la arquitectura
Un desglose real del costo de un chatbot con IA: precio por token de Claude, cobro por mensaje de WhatsApp y el marco de cinco capas de Cognitiva para presupuestar antes de cotizar.
¿Cuánto cuesta un chatbot con inteligencia artificial para una empresa? No existe una cifra única honesta: existe una arquitectura de costos con cinco capas, y la mayoría de las cotizaciones muestra un rango de precio sin explicar cuál de esas capas lo compone. En Cognitiva, firma chilena de ingeniería digital especializada en IA, armamos este desglose con dos fuentes primarias públicas: la tabla de precios por token de Anthropic para los modelos Claude y el modelo de cobro por mensaje de Meta para WhatsApp Business Platform. El resultado es un marco de cinco capas —modelo y tokens, canal o proveedor de WhatsApp, orquestación, observabilidad y mantenimiento humano de los prompts— que un gerente de operaciones o de tecnología puede usar para presupuestar antes de sentarse con un proveedor, no después de firmar. Este artículo no entrega un precio cerrado: entrega la arquitectura que explica por qué dos cotizaciones para el mismo chatbot pueden diferir en varias veces, y qué preguntas hacer para que la comparación sea real. Las cifras citadas están vigentes al 30 de julio de 2026 y provienen directamente de la documentación oficial de cada proveedor.
Qué determina el costo real de un chatbot con IA
Antes de presupuestar conviene distinguir qué se está cotizando. En un artículo anterior explicamos la diferencia entre un chatbot que sigue reglas fijas y un agente de IA que entiende el contexto y ejecuta acciones sobre otros sistemas: la arquitectura de costos de este artículo aplica sobre todo al segundo caso, el que factura por cada token que el modelo procesa, no por mensaje enviado desde un menú de opciones.
Cuando dos proveedores cotizan el mismo chatbot con precios que difieren en varias veces, casi siempre es porque uno incluyó todas las capas y el otro solo una o dos. Un desarrollador puede cotizar únicamente la construcción del flujo (orquestación) y dejar fuera el consumo de modelo y el canal de WhatsApp, que factura aparte y crece con el volumen de conversaciones. El resultado es un precio bajo en la cotización y una factura mensual sorpresiva semanas después.
Las cinco capas son: el modelo de lenguaje y su costo por token, el canal de WhatsApp y su proveedor (BSP), la orquestación que conecta ambos con la lógica de negocio, la observabilidad que mide si el chatbot responde bien, y el mantenimiento humano que ajusta los prompts cuando el negocio cambia. Las dos primeras tienen tarifas públicas y verificables; las tres siguientes dependen del alcance del proyecto y se cotizan por hora o por contrato.
Capa 1: el modelo de lenguaje y el precio por token
Cada vez que el chatbot recibe un mensaje, el modelo procesa tokens de entrada —el mensaje del usuario, el historial de la conversación y las instrucciones del sistema— y genera tokens de salida con la respuesta. Anthropic cobra ambos por separado y a tarifas distintas, en dólares por millón de tokens (MTok), según el modelo Claude que se use.
Sonnet 5 tiene además una tarifa introductoria de USD 2 por millón de tokens de entrada y USD 10 por millón de salida, vigente hasta el 31 de agosto de 2026; desde el 1 de septiembre de 2026 rige la tarifa estándar de USD 3 y USD 15. Para presupuestar de forma duradera —un chatbot no se apaga en septiembre— conviene usar la tarifa estándar como referencia, no la introductoria.
| Modelo | Entrada (USD/MTok) | Salida (USD/MTok) | Uso típico en un chatbot |
|---|---|---|---|
| Opus 5 | $5 | $25 | Casos ambiguos, razonamiento largo, escalamiento a humano |
| Sonnet 5 (desde 01-09-2026) | $3 | $15 | La mayoría de los chatbots de producción |
| Sonnet 5 (introductorio, hasta 31-08-2026) | $2 | $10 | Mismo uso, tarifa de lanzamiento |
| Haiku 4.5 | $1 | $5 | Preguntas frecuentes, clasificación, alto volumen |
El costo por conversación no es fijo: crece con el historial. Cada mensaje nuevo reenvía la conversación completa como contexto, así que una conversación larga cuesta más en tokens de entrada que una corta con la misma pregunta. Anthropic ofrece prompt caching para amortiguar ese crecimiento: un acierto de caché cuesta el 10% del precio base de entrada, así que reutilizar el mismo bloque de contexto —instrucciones del sistema, base de conocimiento— entre turnos de la conversación reduce el gasto de forma significativa.
Capa 2: el canal de WhatsApp y el modelo de cobro de Meta
El modelo cuesta por token; el canal cuesta por mensaje, y las reglas son distintas. Meta cobra tres categorías de plantilla saliente en WhatsApp Business Platform —marketing, utilidad y autenticación—, con tarifas que varían según la categoría y el código de país del número que recibe. Las conversaciones de servicio son gratuitas para todas las empresas desde el 1 de noviembre de 2024.
Lo que casi ninguna cotización aclara: los mensajes de texto libre que el chatbot envía dentro de la ventana de servicio al cliente de 24 horas no se cobran. Llegan etiquetados free_customer_service en el webhook de Meta. Todas las plantillas de marketing se cobran; las de utilidad y autenticación pueden acceder a tarifas menores según el volumen de mensajes, y solo las de utilidad viajan gratis cuando se entregan dentro de una ventana de servicio abierta.
El precio exacto por mensaje varía por país y categoría, y Meta lo publica en un tarifario específico por moneda, incluido el peso chileno (CLP). No existe una tarifa plana para Chile: el número correcto para presupuestar es el que aparece en ese tarifario para tu categoría de mensaje, no un promedio genérico encontrado en internet.
Sobre ese canal se monta un proveedor —Twilio, 360dialog, Gupshup o Wati, entre otros— que agrega su propia tarifa por gestionar la cuenta, la API y el soporte. Comparamos los cuatro en detalle, con rangos de costo mensual, en nuestro artículo sobre BSPs de WhatsApp para pyme chilena.
Capas 3 a 5: orquestación, observabilidad y mantenimiento humano
Las dos primeras capas tienen tarifas públicas. Las tres siguientes no: se cotizan según el alcance del proyecto, y son las que más varían entre un proveedor y otro porque dependen del trabajo de ingeniería, no de una tabla de precios.
Orquestación
Es el código que conecta el modelo con WhatsApp y con los sistemas del negocio: recibe el webhook de Meta, arma el prompt con el contexto correcto, llama al modelo, procesa la respuesta y —si el agente ejecuta acciones— consulta o actualiza el CRM, el sistema de agenda o el catálogo. Esta capa se cotiza por horas de desarrollo, según la cantidad de integraciones y la complejidad de la lógica de negocio.
Observabilidad
Incluye el registro de conversaciones, el monitoreo de errores y la evaluación continua de si el chatbot responde bien o alucina. Sin esta capa, nadie se entera de que el chatbot empezó a responder mal hasta que un cliente se queja. Es una de las capas que un proveedor puede omitir para bajar el precio inicial de la cotización.
Mantenimiento humano de prompts
Un prompt no se escribe una vez y queda listo para siempre. El negocio cambia —nuevos productos, nuevas políticas, nuevas objeciones de clientes— y alguien tiene que revisar conversaciones reales y ajustar las instrucciones del modelo en consecuencia. Es la capa que con más frecuencia falta en una cotización de implementación, porque se factura como servicio continuo, no como proyecto único.
El marco de cinco capas de Cognitiva para presupuestar antes de cotizar
Para que la comparación entre proveedores sea real, en Cognitiva usamos un marco de cinco capas antes de recibir cualquier cotización. No reemplaza al proveedor: ordena las preguntas que hay que hacerle.
| Capa | Qué incluye | Quién la determina |
|---|---|---|
| 1. Modelo y tokens | Consumo de entrada y salida del modelo Claude usado | Tarifa pública de Anthropic, según modelo elegido |
| 2. Canal / BSP | Mensajes de WhatsApp cobrados por Meta más tarifa del proveedor (BSP) | Tarifa pública de Meta más contrato con el BSP |
| 3. Orquestación | Desarrollo del backend que conecta modelo, canal y sistemas del negocio | Horas de ingeniería según alcance |
| 4. Observabilidad | Registro, monitoreo y evaluación de calidad de las respuestas | Horas de ingeniería más herramientas de monitoreo |
| 5. Mantenimiento humano | Revisión y ajuste continuo de prompts tras el lanzamiento | Servicio continuo, no proyecto único |
Antes de aceptar una cotización, conviene pedirle al proveedor que ubique su precio en esta tabla: qué capas incluye, cuáles factura aparte y cuáles no contempla. Es la forma más rápida de comparar dos propuestas que a primera vista parecen solo números sueltos.
Una cotización de chatbot que no distingue estas cinco capas no es una cifra: es un rango sin arquitectura detrás.
Un ejemplo con los números oficiales
Anthropic publicó un ejemplo propio que sirve como referencia de orden de magnitud, no como promedio universal: procesar 10.000 tickets de soporte con Haiku 4.5, asumiendo un promedio de aproximadamente 3.700 tokens por conversación, cuesta cerca de USD 37 en consumo de modelo.
Lo útil del ejemplo no es la cifra final, sino el método: Anthropic la construye multiplicando un volumen de conversaciones por un consumo de tokens estimado y por la tarifa del modelo elegido. Ese mismo método —volumen por tokens por conversación por tarifa— es el que permite estimar la capa 1 antes de cotizar, siempre que el volumen y el consumo de tokens se midan con datos reales de la operación, no con un promedio de internet.
Errores frecuentes al presupuestar un chatbot con IA
- Pedir el precio de un chatbot sin especificar el modelo de IA, el volumen mensual de conversaciones ni el canal.
- Asumir que el costo de WhatsApp está incluido en la cotización del desarrollo, cuando el BSP lo factura aparte.
- No preguntar si el precio cotizado es de implementación única o incluye el consumo continuo de modelo y canal.
- Ignorar que el historial de conversación hace crecer el costo por token con el tiempo, no solo con el volumen de usuarios nuevos.
- No presupuestar el mantenimiento humano de prompts como costo recurrente, sino como parte del proyecto inicial.
Con las cinco capas identificadas y las tarifas oficiales de cada proveedor a la vista, una cotización deja de ser un número de venta y pasa a ser una arquitectura que se puede auditar. Esa es la diferencia entre presupuestar antes de cotizar y descubrir el costo real semanas después de firmar.
Preguntas frecuentes
Da el siguiente paso
Hablemos
Cuéntanos qué tienes que resolver. Respondemos dentro de un día hábil.
Otros canales
Escríbenos por WhatsApp o solicita una evaluación de tu operación.