Agentes de voz y atención telefónica
Atienden llamadas, cualifican y pasan a una persona cuando toca — sin dejar a nadie esperando
Con liberar 7,9 horas a la semana, ya está pagado.
El teléfono suena cuando no hay nadie: a la hora de comer, a las ocho de la tarde, en agosto. Cada llamada perdida es un cliente que llama al siguiente de la lista, y nunca sabrás cuántos fueron.
Qué hacemos
Montamos un agente que descuelga siempre, entiende para qué llaman, resuelve lo que puede resolver y pasa a una persona lo que no — con el contexto ya recogido, para que nadie tenga que repetirse.
Se diseña con la salida siempre disponible: pedir hablar con una persona funciona a la primera, sin laberinto de menús. Un sistema que atrapa al que llama hace más daño que no cogerle el teléfono.
Fuera de horario recoge el motivo y devuelve la llamada a primera hora, en vez de dejar un buzón que nadie escucha.
Cómo funciona
Dónde vive el dato
Retorno de la inversión
Con liberar 7,9 horas a la semana, ya está pagado.
En un caso típico libera unas 30 h al mes, por encima de ese listón.
- Coste actual del proceso
- 3325 € /mes
- Horas liberadas al mes
- 30 h
- Inversión de implantación
- 8600 €
- Operación
- 480 € /mes
- Ahorro neto
- 567 € /mes
- Punto de equilibrio
- 16 meses
- Resultado a 12 meses
- -1791 €
Supuestos de este cálculo (4)
- 95 h/mes de atención telefónica en una empresa con volumen medio de llamadas
- El 45% es prudente: la voz tolera menos automatización que el texto
- Factor de realismo del 70% sobre esa parte
- No se contabilizan las llamadas recuperadas fuera de horario, que suelen ser el mayor retorno real
Qué incluye
- Guion conversacional adaptado a los motivos reales de llamada
- Escalado inmediato a persona cuando se pide o cuando el caso lo requiere
- Recogida de motivo y datos fuera de horario
- Transcripción y resumen de cada llamada
- Panel de motivos, para ver qué se pregunta más
Con qué lo montamos
No trabajamos con una sola herramienta ni te casamos con ninguna. Esto es lo que solemos usar para este servicio y para qué sirve cada pieza — si ya tienes algo montado, partimos de ahí.
- Twiliotelefonía y numeración SIP
- Telnyxalternativa de operador con numeración europea
- LiveKitel transporte de audio en tiempo real
- Pipecatel bucle voz-modelo-voz, autoalojable
- Vapi / Retellplataforma gestionada cuando urge salir rápido
- Deepgram / AssemblyAItranscripción en directo con baja latencia
- Whispertranscripción local cuando la llamada no puede salir
- ElevenLabs / Cartesiala voz sintética y su clonado con permiso
- n8nenruta la llamada y avisa a quien toca
- HubSpot / Pipedrivedeja la llamada registrada en el CRM
Cada una de estas piezas está catalogada en el stack, con lo importante: si se ejecuta dentro de tu empresa o si al meterla tu dato empieza a viajar.
Con qué motor lo movemos
Preferimos montarlo dentro de tu red, con un modelo abierto en tu propio servidor: es la única forma de que el dato no dependa de las condiciones de un tercero. Cuando eso no encaja — por presupuesto o porque no hace falta — trabajamos con modelos low cost adaptados a lo que puedas gastar, o con modelos frontera si la tarea lo pide. Para este servicio proponemos la capa marcada, pero se cambia sin rehacer el trabajo.
En tu servidor
El dato no sale. Es lo que preferimos.
- Cuándo
- Historiales, expedientes, nóminas, contratos, datos de salud, sector público — o cualquier cosa que no puedas explicar en una auditoría si acaba fuera.
- Tu dato
- No cruza el límite de tu empresa. Ni tu proveedor de nube ni nosotros vemos el contenido.
- Cómo se paga
- Inversión inicial en hardware y después coste plano: no sube aunque dupliques el uso.
- LlamaMeta · pesos abiertos
- QwenAlibaba · pesos abiertos
- DeepSeekChina · pesos abiertos
- MistralFrancia · pesos abiertos
- GemmaGoogle · pesos abiertos
- gpt-ossOpenAI · pesos abiertos
API de bajo coste
Lo que proponemos aquí
Potencia de sobra por céntimos.
- Cuándo
- Cuando el dato puede salir y lo que manda es el volumen: clasificar, extraer, traducir, resumir, etiquetar. Miles de operaciones al mes donde lo que cuenta es el precio por unidad.
- Tu dato
- Sale al proveedor que elijas. Te decimos cuál, en qué país están sus servidores y qué dicen sus condiciones de empresa sobre entrenar con lo que les mandas.
- Cómo se paga
- Céntimos por millón de palabras. Es la capa que hace viables los volúmenes grandes sin comprar una máquina.
- Kimi K2Moonshot · China
- DeepSeekChina
- MistralFrancia · Europa
- Gemini FlashGoogle · EE. UU.
- GrokxAI · EE. UU.
- GPT miniOpenAI · EE. UU.
Modelos frontera
Cuando el trabajo es difícil de verdad.
- Cuándo
- Razonamiento largo, código, análisis jurídico o financiero, agentes que encadenan veinte pasos sin que nadie mire. Donde una respuesta mediocre cuesta más de lo que cuesta el modelo.
- Tu dato
- Sale al proveedor. Leemos sus condiciones de empresa y te las resumimos por escrito antes de firmar nada.
- Cómo se paga
- El precio por palabra más alto del mercado — y a menudo el coste por tarea resuelta más bajo, porque acierta a la primera y no hay que revisarlo.
- Claude Opus 5Anthropic · EE. UU.
- GPT-5OpenAI · EE. UU.
- Gemini ProGoogle · EE. UU.
En la práctica casi nunca es uno solo
Lo normal es enrutar: el modelo barato se come el 90% del volumen y solo lo que de verdad es difícil sube al modelo frontera. Si además hay dato sensible, esa parte se queda en el servidor local y nunca entra en el enrutado. Se factura la mezcla, no el modelo más caro — y ahí es donde una factura de IA se divide entre tres o entre diez.
Cómo elegimos el motor, en detalle →Qué necesitamos de ti
- Los motivos de llamada más frecuentes, o grabaciones si las tenéis
- Acceso a la centralita o al número a desviar
- A quién se escala cada tipo de caso
Plazo típico: 4 a 7 semanas
Lo que sueles preguntarte
¿Cuánto tarda en estar funcionando?
4 a 7 semanas, contando desde que tenemos los accesos. El plazo exacto va en la propuesta, no lo dejamos abierto.
¿Salen mis datos de la empresa?
Sí, en parte: este servicio envía datos a proveedor de voz · UE. Lo decimos aquí y queda por escrito en la propuesta, para que la decisión la tomes con la información delante.
¿Con qué modelo de IA lo montáis?
Aquí sale a cuenta una API de bajo coste (Kimi, DeepSeek, Mistral, Gemini Flash…) porque manda el volumen. Si hace falta más calidad en una parte, esa parte sube a un modelo frontera. Preferimos la seguridad del dato y montar red y sistemas en local, pero trabajamos con las tres capas: modelos abiertos en tu propio servidor, LLM de bajo coste adaptados al presupuesto —chinos como Kimi K2 o DeepSeek, europeos como Mistral, estadounidenses como Gemini o Grok— y modelos frontera como Claude Opus 5 o GPT-5. El motor se cambia en la configuración sin rehacer el trabajo.
¿Cuánto tiene que funcionar para que me salga a cuenta?
Con liberar 7,9 horas a la semana, ya está pagado. En un caso típico libera unas 30 h al mes, por encima de ese listón. Los supuestos del cálculo están publicados en esta misma página, para que puedas discutirlos.
¿Qué necesitáis de mi parte?
Los motivos de llamada más frecuentes, o grabaciones si las tenéis; Acceso a la centralita o al número a desviar; A quién se escala cada tipo de caso. Nada más: el resto del trabajo es nuestro.
¿Cuándo NO me conviene contratarlo?
Si tus llamadas son largas, consultivas y cada una distinta, un agente de voz frustra más de lo que ayuda. Ahí conviene un asistente que prepare la llamada, no que la sustituya.
¿Puedo mantenerlo yo después, sin vosotros?
Sí. Todo lo que montamos se entrega documentado y con traspaso al equipo. No trabajamos con cajas negras.
¿Encaja con lo que necesitas?
Cuéntanos el proceso concreto y te decimos si este servicio es el que te conviene — o cuál de los otros 48 lo es.