Retell AI en español: precios 2026 y alternativa a medida

📌 En resumen

Retell AI es la plataforma SaaS de moda para montar agentes de voz telefónicos en menos de una semana. En este artículo verás qué hace exactamente, cuánto cuesta de verdad (con cifras desglosadas 2026), cuándo te conviene y cuándo te conviene más una implementación a medida con ElevenLabs, Twilio y n8n. Sin marketing, números reales y comparativa con Vapi y Synthflow.

Qué es Retell AI exactamente (y qué no es)

Retell AI es una plataforma estadounidense que te permite construir agentes de voz conversacionales para teléfono. Es decir, montas un agente que coge el teléfono cuando llama un cliente, lo entiende, responde con voz natural, consulta sistemas externos durante la conversación y deja registro de lo hablado. El mismo agente puede también hacer llamadas salientes para recordar citas, cobrar morosos o lanzar encuestas.

Lo importante para no liarse: Retell no es un proveedor de voz, no compite con ElevenLabs. Retell es la capa de orquestación que pega tres piezas que ya existen por separado.

  • STT (speech-to-text): convierte lo que dice el cliente en texto.
  • LLM (modelo de lenguaje): decide qué responder. GPT, Claude, Gemini, lo que elijas.
  • TTS (text-to-speech): vocaliza la respuesta. Aquí entra ElevenLabs como uno de los proveedores opcionales.

Encima de esos tres, Retell añade telefonía (vía Twilio o Vonage por debajo), gestión de turnos, detección de interrupciones, transferencias a humano, transcripción, webhooks y un panel para diseñar el flujo del agente. La gracia es que lo monta en una caja única con SDK, dashboard y facturación unificada.

Cómo funciona técnicamente, en una imagen mental

Cuando un cliente llama a tu número:

  1. Twilio recibe la llamada y la pasa a Retell.
  2. Retell envía el audio entrante al motor STT, que lo transcribe casi en tiempo real.
  3. El texto va al LLM con el contexto del agente y el historial de la conversación.
  4. El LLM decide qué responder. Si necesita datos externos (consultar disponibilidad, mirar el estado de un pedido, registrar una cita), llama a una función que tú has definido y que apunta a tu API, webhook o sistema.
  5. La respuesta del LLM va al motor TTS, que la convierte en voz.
  6. Retell devuelve el audio a Twilio, que lo reproduce al cliente.

Todo ese ciclo ocurre en menos de un segundo cuando está bien afinado. Si tarda más, el cliente percibe que el agente "se piensa las cosas" y la conversación pierde naturalidad.

Precios reales de Retell AI en 2026

Retell trabaja con un modelo pay-as-you-go transparente, pero engañoso a primera vista. El precio por minuto que ves anunciado, entre 0,07 y 0,31 dólares, depende de qué LLM y qué voz elijas. Vamos al desglose real.

ComponenteCoste por minuto
Infraestructura Retell0,055 $
Voz Retell, Cartesia, OpenAI, Minimax o Fish0,015 $
Voz ElevenLabs (si la prefieres)0,040 $
LLM Gemini 2.5 Flash0,035 $
LLM GPT 4.10,045 $
LLM Claude 4.5 Sonnet0,080 $
LLM GPT 5.50,16 $

Suma los tres bloques (infra + voz + LLM) y tienes tu coste real. Un agente con voz estándar y Gemini Flash sale a 0,105 $/min. Con voz de ElevenLabs y Claude Sonnet sube a 0,175 $/min. Con la voz top y GPT 5.5, los famosos 0,31 $/min.

A esto hay que sumar lo que casi nadie cuenta:

  • Concurrencia: 20 llamadas simultáneas incluidas. Cada slot adicional cuesta 8 $/mes.
  • Número telefónico Retell: 2 $/mes por número.
  • Base de conocimiento (si quieres que el agente consulte documentos): 8 $/mes a partir de la décima.
  • Eliminación de PII en transcripciones: 0,01 $/min.
  • Calidad por IA (revisión automática de llamadas): 0,10 $/min tras los 100 minutos gratis.

📊 Ejemplo realista

Una clínica con 1.000 minutos de llamada al mes, voz natural ElevenLabs y Claude Sonnet pagaría aproximadamente 175 $ en consumo, más 2 $ del número, más 8 $ por cada slot extra de concurrencia que necesite por encima de los 20 incluidos. Total estimado: 185-220 $/mes. Sin contar el tiempo de tu equipo configurando el flujo o el coste de un consultor externo que lo monte por ti.

Cuándo Retell AI es la elección correcta

Retell es honesto: te lleva del cero al ochenta por ciento en una semana. Y eso es muchísimo. Hay escenarios donde es exactamente lo que necesitas.

  • Pruebas de concepto rápidas. Quieres validar si un agente de voz funcionará en tu negocio antes de invertir más. Con 10 $ de crédito gratis lanzas un piloto en dos días.
  • Casos estándar con flujos simples. Tomar reservas en un restaurante, calificar leads inbound, contestar preguntas frecuentes con un script claro. Si tu flujo cabe en una pizarra, Retell te lo monta.
  • Equipos sin developer. Si en tu empresa no hay nadie que sepa programar, el dashboard de Retell te permite construir el flujo en visual y empezar a llamar.
  • Volumen bajo o medio. Por debajo de 5.000 minutos al mes, los pequeños sobrecostes por minuto no duelen lo suficiente para justificar la inversión inicial de una implementación a medida.

Cuándo Retell se queda corto

El otro lado de la balanza. Hay escenarios donde Retell no es la herramienta adecuada, aunque al principio parezca que sí.

  • Integraciones profundas con tu CRM o ERP propio. Retell tiene conectores con HubSpot, GoHighLevel y poco más. Si tu cliente trabaja con un Holded, un Odoo a medida, un ERP propietario o una base de datos antigua, vas a tener que montar webhooks intermedios igualmente, y entonces tu stack ya es híbrido sin haberlo decidido.
  • Multi-tenant para una agencia o consultora. Retell no separa bien clientes ni facturación. Si quieres revender el servicio a tus propios clientes con marca blanca y cuentas independientes, te toca duplicar agentes a mano y la operativa se descontrola.
  • Volumen alto sostenido. A partir de 10.000-15.000 minutos al mes, el 0,055 $ de infra por minuto empieza a pesar. Con una implementación a medida pagas Twilio directo y eliminas esa capa, lo que te ahorra cientos de dólares al mes que recuperan rápido la inversión inicial.
  • Compliance específico. Datos sanitarios bajo RGPD reforzado, llamadas en jurisdicción europea con almacenamiento garantizado en la UE, requisitos sectoriales raros. Retell cumple lo estándar, no lo a medida.
  • Cuando quieres que el agente realmente "piense". La arquitectura de Retell te obliga a definir el flujo paso a paso. Para conversaciones abiertas reales, donde el agente tiene que tomar decisiones complejas o navegar entre temas sin script, el enfoque a medida con un agente LLM bien diseñado da resultados más naturales.

Comparativa honesta: Retell vs Vapi vs implementación a medida

Dejemos a Retell un momento y veamos qué hay alrededor.

SoluciónCoste plataformaTiempo arranqueControlIdóneo para
Retell AI 0,055 $/min + LLM + TTS 1-2 semanas Medio Pyme que arranca, casos estándar
Vapi 0,05 $/min + LLM + TTS (puedes traer tus claves) 1-2 semanas Medio-alto Equipo técnico que quiere flexibilidad
Synthflow Enterprise desde 30.000 $/año 4-8 semanas Alto pero cerrado Grandes cuentas con presupuesto
ElevenLabs Voice Agents Tarifa por minuto del plan ElevenLabs 1-3 semanas Medio Casos donde la calidad de voz es lo crítico
Implementación a medida (ElevenLabs + Twilio + n8n + LLM) Solo coste real de cada API, sin capa intermedia 3-6 semanas Total B2B serio, integraciones profundas, volumen alto

Vapi es el competidor más directo de Retell en filosofía. Más flexibilidad técnica, algo menos pulido en dashboard. Synthflow se ha movido a contratos enterprise grandes y deja fuera a la pyme. ElevenLabs Voice Agents es la apuesta de ElevenLabs por subir en la cadena de valor, pero es reciente y todavía tiene limitaciones de orquestación.

La opción que casi nadie te cuenta: implementación a medida

La gran ventaja de las plataformas tipo Retell es también su gran limitación: te encierran en su arquitectura. La alternativa madura es montar las mismas piezas tú mismo y conectarlas a tu medida.

El stack típico que usamos en nacaIA para clientes B2B serios:

  • Twilio: telefonía. Numeración española, internacional y portabilidad. Coste real: aproximadamente 0,013 $/min entrante.
  • ElevenLabs: motor de voz (TTS y opcionalmente STT). La voz más natural del mercado y soporte real para español.
  • LLM directo (Claude o GPT vía API): el cerebro del agente, sin capa intermedia que añada latencia o coste.
  • n8n self-hosted: orquestación, lógica de negocio, integraciones con CRMs, agendas, ERPs, bases de datos. Sin coste por uso.

Ventajas frente a Retell:

  • Sin coste de la capa de orquestación (esos 0,055 $/min que Retell cobra extra).
  • Integraciones reales con cualquier sistema, no solo los que vienen de serie.
  • Sin lock-in. Mañana cambias el LLM, el TTS o el proveedor de telefonía sin tocar el resto.
  • Multi-tenant real si lo necesitas para una agencia.
  • Almacenamiento de transcripciones y datos donde tú decidas (UE, on-premise, encriptado, etc.).

Desventajas:

  • Inversión inicial mayor. Una implementación bien hecha lleva 3 a 6 semanas frente a los 7 a 10 días de Retell.
  • Requiere a alguien que sepa lo que hace. No es un dashboard, es código y configuración real.
  • El mantenimiento es tuyo o de tu proveedor. Si algo se rompe, no hay un soporte 24/7 al que tirar.

Cuánto cuesta cada opción a 1.000 minutos al mes

El ejemplo concreto suele aclarar más que toda la teoría. Estimación para 1.000 minutos al mes (unas 33 llamadas de 30 minutos diarias, perfil clínica o asesoría media).

OpciónCoste mensual estimadoImplementación inicial
Retell AI con voz ElevenLabs y Claude Sonnet175-220 $De 0 a 3.000 € según configuración
Vapi con BYOK120-170 $De 0 a 4.000 € según configuración
Implementación a medida (ElevenLabs + Twilio + n8n + Claude)110-150 $2.500-6.000 €

A 1.000 minutos al mes la diferencia mensual es pequeña, entre 60 y 100 $ a favor del a medida. La inversión inicial mayor se amortiza típicamente en 18 a 30 meses, según el plan. Pero el verdadero valor del a medida no está ahí, sino en lo que NO ves en una tabla: integraciones con tu CRM real, control sobre tus datos, capacidad de evolucionar el agente sin pedir permiso a una plataforma externa.

Cuando el volumen sube a 5.000 o 10.000 minutos al mes, la diferencia mensual empieza a ser de varios cientos de dólares y la inversión inicial se recupera en menos de un año.

Cómo decidir en 5 preguntas

Si estás dudando, contéstate esto:

  1. ¿Quiero validar la idea en 1-2 semanas con coste mínimo? → Retell o Vapi.
  2. ¿El flujo del agente cabe en una pizarra y no necesita decisiones complejas? → Retell.
  3. ¿Voy a integrarlo con un sistema raro o propio (Holded, Odoo, ERP a medida, base de datos heredada)? → Implementación a medida.
  4. ¿Estoy montando un servicio que voy a revender a varios clientes con cuentas separadas? → Implementación a medida.
  5. ¿Voy a manejar más de 5.000 minutos al mes de forma sostenida? → Implementación a medida.

Si has contestado "Implementación a medida" a 2 o más de las 5 preguntas, el camino claro es ese aunque tarde un poco más en arrancar.

Preguntas frecuentes sobre Retell AI

¿Retell AI funciona en español?

Sí. Retell soporta más de 18 idiomas incluido el español, tanto peninsular como latinoamericano. La calidad de la voz depende del proveedor TTS que elijas. ElevenLabs y Cartesia tienen voces muy naturales en español. Si vas a operar exclusivamente en España, te recomendamos hacer una prueba con voces ElevenLabs específicas para castellano antes de cerrar la decisión.

¿Cuánto cuesta Retell AI realmente?

El precio anunciado de 0,07 a 0,31 $ por minuto es real pero depende del LLM y la voz que elijas. Un setup razonable (voz natural y modelo bueno pero no top) ronda los 0,15-0,18 $ por minuto. A esto súmale 2 $/mes por número, 8 $/mes por slot de concurrencia extra y otros add-ons opcionales. Para 1.000 minutos mensuales calcula entre 175 y 220 $ totales.

¿Se puede integrar Retell AI con n8n?

Sí. Retell expone webhooks y una API REST que n8n consume sin problema. Puedes hacer que el agente, durante la llamada, dispare un workflow n8n para consultar tu base de datos, crear un registro en tu CRM, enviar un email o lo que necesites. Lo malo es que estás añadiendo otra capa de orquestación encima de la que ya tiene Retell, lo que en cierto punto te lleva a plantearte si no sería más limpio montar el agente directamente sobre n8n sin Retell por medio.

¿Retell AI vs Vapi, cuál elijo?

Vapi es más flexible técnicamente y permite traer tus propias claves de API (lo que ahorra dinero si ya tienes contratos con OpenAI o ElevenLabs). Retell tiene un dashboard más pulido y curva de aprendizaje más suave. Si tienes equipo técnico, Vapi suele salir más barato y dar más control. Si no, Retell es más amable.

¿Puedo usar ElevenLabs dentro de Retell AI?

Sí, ElevenLabs es uno de los proveedores TTS soportados por Retell. Cuesta 0,040 $ por minuto frente a los 0,015 $ de las voces estándar de Retell, pero la calidad es notablemente superior. Para casos donde el cliente final escucha mucho la voz (atención al cliente, ventas), merece la pena el sobrecoste.

¿Cuándo conviene una implementación a medida frente a Retell?

Cuando se cumple al menos uno de estos tres: vas a integrar con sistemas no estándar (CRM o ERP propio), vas a revender el servicio a varios clientes con marca blanca, o vas a manejar más de 5.000 minutos al mes. En esos casos los sobrecostes de Retell se acumulan y las limitaciones de su arquitectura empiezan a estorbar. Por debajo de esos umbrales, Retell suele ser la opción rápida y razonable.

¿Retell AI cumple con el RGPD?

Cumple los estándares básicos pero los datos pasan por servidores estadounidenses. Si tu caso requiere almacenamiento garantizado en la UE, retención personalizada o requisitos sectoriales (sanitarios, financieros), te toca leer la letra pequeña y posiblemente complementar con políticas adicionales. Una implementación a medida en infraestructura europea evita ese debate desde el día uno.

Conclusión: Retell es buena herramienta, no la única respuesta

Retell AI ha hecho fácil algo que hace dos años era complicado: montar agentes de voz que suenen humanos y funcionen. Por eso tiene 2.900 búsquedas mensuales en España y crece. Pero la pregunta correcta no es "¿uso Retell sí o no?", sino "¿qué necesito de verdad y cuál es el camino más sensato para llegar?".

Si estás validando una idea, montando un piloto rápido o atacando casos estándar de bajo volumen, Retell te lo pone en bandeja y vas con ello. Si tu proyecto tiene integraciones profundas, multi-tenant, volumen alto o requisitos especiales, una implementación a medida te da control real, mejor coste a medio plazo y libertad para evolucionar.

En nacaIA hacemos las dos cosas. Empezamos con muchos clientes en Retell o Vapi como prueba de concepto en dos semanas, y cuando el negocio se valida y crece, pasamos a una implementación propia que escala sin sorpresas. Sin religión técnica, lo que funcione para el cliente.

¿Quieres ver agentes de voz funcionando en empresas reales?

Ver casos en clínicas, asesorías y comercios
JB

Jorge Benítez

Fundador de nacaIA · Especialista en automatizaciones con n8n y desarrollo de software

Ayudo a empresas a automatizar procesos con n8n, IA y desarrollo a medida. Más sobre mí →