Agente de voz IA para agendar citas: implementacion paso a paso
Agente de voz IA para agendar citas: implementacion paso a paso
Para implementar un agente de voz IA que agende citas de forma automatica en tu empresa, necesitas una plataforma de voz IA (Retell AI o Vapi), un sistema de calendario con API (Google Calendar o Cal.com) y un webhook que conecte ambos. El resultado: atencion al cliente 24/7 sin operadores humanos para consultas de disponibilidad y agendamiento.
Por que las empresas estan migrando a agentes de voz IA
Cada llamada perdida fuera de horario es una cita que no se agenda. En sectores como salud, educacion, servicios profesionales y bienes raices, entre el 30% y el 60% de las llamadas de agendamiento llegan en horarios no atendidos (Retell AI, 2025). Un agente de voz IA elimina ese problema: atiende llamadas, consulta el calendario en tiempo real y confirma la cita sin intervencion humana.
La diferencia con una grabacion IVR tradicional es la capacidad de mantener una conversacion: el agente de voz IA entiende preguntas abiertas ("quiero una cita para la proxima semana en la manana"), consulta disponibilidad real y confirma el horario en la misma llamada.
Segun datos de Vapi (2025), los negocios que despliegan agentes de voz IA para agendamiento reportan una tasa de conversion de llamadas a citas entre 2.1x y 3.4x superior al canal IVR clasico. La diferencia esta en la conversacion: el agente adapta su respuesta segun lo que dice el cliente, no segun el numero que presiona.
Requisitos previos
- Cuenta en Retell AI (retellai.com) o Vapi (vapi.ai) — ambas soportan espanol latinoamericano con latencia <800ms
- Sistema de calendario con API: Google Calendar, Cal.com (open source) o Calendly
- Numero de telefono SIP o DID (Twilio, Vonage o el integrado de la plataforma — desde $1/mes)
- Endpoint webhook propio (n8n, Make, o un endpoint Node.js/Python)
- Presupuesto estimado: $0.07–$0.15 por minuto de llamada (Retell AI, tarifa 2025)
Paso 1: Configurar el agente de voz en Retell AI
Crea un agente en app.retellai.com. Los campos clave:
Prompt del agente (system prompt):
Configuracion de voz:
- Proveedor: ElevenLabs (mejor calidad) o Azure TTS (mas economico)
- Voz:
Laura(ElevenLabs, espanol neutro) oes-MX-DaliaNeural(Azure) - Latencia objetivo: < 800ms (ajustar en
Response Latencydel panel) - Temperatura del LLM: 0.3 — respuestas consistentes, menos improvisacion
Paso 2: Conectar con el calendario via webhook
El agente necesita consultar disponibilidad en tiempo real. Para esto, defines una herramienta personalizada (tool) en Retell AI:
Tu endpoint /api/availability recibe estos parametros, consulta Google Calendar o Cal.com, y devuelve los slots disponibles como texto simple:
El agente lee esta respuesta y la presenta en voz natural: "Tengo disponibilidad el martes 3 a las 10 de la manana o las 11 y media, y el miercoles 4 a las 9. Cual te viene mejor?"
Para obtener slots libres desde Google Calendar:
Paso 3: Confirmar y registrar la cita
Cuando el cliente elige un horario, el agente llama a una segunda herramienta:
Tu endpoint /api/book hace tres cosas:
- Crea el evento en Google Calendar:
- Envia confirmacion por WhatsApp (Evolution API o Twilio) con fecha, hora y direccion.
- Registra el lead en tu CRM (HubSpot, GHL o la BD interna).
Paso 4: Escalado humano y monitoreo
No todas las llamadas terminan bien. Define un trigger de escalado en el prompt:
En Retell AI, transfer_call es una herramienta nativa que redirige la llamada a un numero SIP o celular. El agente anuncia: "Con gusto te conecto con un asesor, dame un segundo."
Para monitoreo, activa los webhooks de Retell AI que registran: duracion de la llamada, transcripcion completa, si se completo el agendamiento o se escalo, y sentimiento del cliente via analisis de transcripcion. Guarda estos logs en tu BD para iterar el prompt semanalmente.
Arquitectura del sistema
El LLM orquesta, las herramientas ejecutan. El agente de voz es la interfaz — el cerebro es el modelo de lenguaje con acceso a tus sistemas reales.
Lo que aprendimos implementandolo en produccion
- El prompt es el 80% del resultado. Un prompt vago produce respuestas vagas. Escribir el prompt como si le instruyeras a un empleado nuevo: cuando te digan X, pregunta Y antes de ofrecer horarios.
- La latencia de las herramientas mata la conversacion. Si tu endpoint tarda mas de 1.5 segundos, el cliente percibe un silencio incomodo. Usa cache de slots disponibles actualizado cada 5 minutos.
- No intentes hacer todo en una sola llamada. La confirmacion puede llegar por WhatsApp. La llamada cierra el agendamiento; el mensaje escrito entrega los detalles.
- Mide la tasa de completacion, no solo las llamadas. Una llamada de 4 minutos que termino sin cita es una falla del agente, no del cliente. Analiza las transcripciones donde se abandono el flujo.
- El espanol regional importa. El registro informal vs formal genera reacciones distintas segun el pais. Ajusta el tono del agente a tu mercado especifico.
En resumen
- Elige Retell AI o Vapi como plataforma de voz IA (ambas soportan espanol con <800ms de latencia)
- Define el system prompt con instrucciones precisas: flujo, limites y escalado humano
- Conecta al calendario via herramientas personalizadas (webhooks a tu endpoint)
- Implementa
transfer_callpara casos fuera del scope del agente - Mide tasa de completacion y ajusta el prompt cada semana con base en transcripciones
Si quieres implementar esto en tu negocio sin construirlo desde cero, en AgentesNexo lo hacemos por ti. Escribenos en agentesnexo.com o por WhatsApp al +591 67564218
Escríbenos en agentesnexo.com o por WhatsApp al +591 67564218