serviciosia

Atención al cliente de punta a punta

Del primer mensaje al pedido consultado, la devolución tramitada y el humano avisado a tiempo

depende de la arquitectura
Atención al cliente de punta a punta — servicio SRV-41 de serviciosia, nivel de aplicación: el dato sale o no según la arquitectura que elijas.
Atención al cliente de punta a punta — servicio SRV-41 de serviciosia, nivel de aplicación: el dato sale o no según la arquitectura que elijas.

Con liberar 8,7 horas a la semana, ya está pagado.

Un chatbot que solo contesta preguntas frecuentes molesta más de lo que ayuda: el cliente ya ha leído las preguntas frecuentes y por eso escribe. Lo que necesita es que alguien mire su pedido, tramite su devolución o le dé una cita. Y lo que necesita tu equipo es no contestar por decimoquinta vez dónde está el paquete.

Qué hacemos

El asistente consulta de verdad: entra en tu sistema, mira el pedido de ese cliente, comprueba el estado del envío y contesta con el dato real. Eso es lo que separa un asistente útil de un formulario con conversación.

Y ejecuta lo que le autorices: iniciar una devolución, cambiar una dirección de envío, dar una cita, emitir un duplicado de factura. Cada acción con su límite escrito — importe máximo, ventana de días, casos que siempre pasan por una persona.

El escalado no es un botón perdido: cuando el caso se sale del guion, cuando el cliente se enfada o cuando toca decidir algo con dinero de por medio, pasa a una persona con la conversación entera resumida. Nadie tiene que repetir su problema.

Funciona en el canal donde ya te escriben —web, WhatsApp, correo, teléfono— y todo cae en la misma cola, con el mismo histórico. Y medimos lo único que importa: qué porcentaje se resuelve sin humano y con qué satisfacción, no cuántos mensajes procesó.

Cómo funciona

Diagrama de funcionamiento de Atención al cliente de punta a punta: el dato entra desde tus sistemas, se procesa dentro de tu red y el resultado vuelve sin cruzar el límite.TU EMPRESATus sistemasZendesk · Freshdesk ·…entraMotor (dentro o fuera)Atención al cliente de punta…devuelve el resultado a tu sistemaTu equiporevisa y decideno cruza el límite
Todo el recorrido ocurre dentro de tu red: entra desde Zendesk · Freshdesk · Zammad · CRM · ERP · pasarela de envíos, se procesa en tu servidor y vuelve. Ni tu proveedor de nube ni nosotros vemos el contenido.

Dónde vive el dato

El motor y la base de conocimiento pueden vivir dentro de tu red. Lo que sí sale, inevitablemente, es lo que viaja por el canal que uses: WhatsApp pasa por Meta, el correo por tu proveedor. Eso ya ocurre hoy sin IA, y lo dejamos escrito igual.

Diagrama: el dato se procesa dentro de tu red, y una parte cruza el límite hacia proveedor externo.TU EMPRESALÍMITEDocumentosModelono cruzaConsultaproveedor externosale de la empresa
El procesado ocurre dentro de tu red, pero parte del recorrido cruza el límite hacia proveedor externo. Queda escrito en la propuesta.

Retorno de la inversión

Con liberar 8,7 horas a la semana, ya está pagado.

En un caso típico libera unas 37 h al mes, por encima de ese listón.

Curva de amortización: lo ahorrado supera a lo invertido en el mes 13, y a partir de ahí el servicio deja de costar dinero.mes 13 · ya está pagadolo que llevas invertidolo que llevas ahorradohoy24 meses33.530 €0 €
Las dos líneas se cruzan en el mes 13. A partir de ahí la franja verde es dinero que te queda, no que gastas — y a los 24 meses son 11.086 €.
Coste actual del proceso
3360 € /mes
Horas liberadas al mes
37 h
Inversión de implantación
11.800 €
Operación
340 € /mes
Ahorro neto
954 € /mes
Punto de equilibrio
13 meses
Resultado a 12 meses
-357 €
Supuestos de este cálculo (4)
  • 96 h/mes equivale a algo más de media jornada dedicada a atención repetitiva
  • El 55% es la parte que se resuelve sin persona en implantaciones con acceso real al sistema de pedidos
  • Sin acceso al sistema, ese porcentaje baja a la mitad — por eso la integración no es opcional
  • No contabiliza la venta recuperada por contestar fuera de horario

Qué incluye

  • Asistente conectado a tu sistema de pedidos, CRM o ERP para consultar de verdad
  • Acciones autorizadas con límites escritos: devoluciones, citas, cambios de dirección
  • Base de conocimiento sobre tu documentación real, con cita de la fuente
  • Escalado a persona con resumen de la conversación y motivo del traspaso
  • Canales unificados: web, WhatsApp, correo y opcionalmente teléfono
  • Panel con tasa de resolución sin humano, motivos de escalado y satisfacción
  • Revisión mensual de las conversaciones que se escalaron, para cerrar huecos

Con qué lo montamos

No trabajamos con una sola herramienta ni te casamos con ninguna. Esto es lo que solemos usar para este servicio y para qué sirve cada pieza — si ya tienes algo montado, partimos de ahí.

  • Zammad / Freshdeskla cola unificada de todos los canales
  • n8nlas acciones autorizadas y el escalado
  • PostgreSQL + pgvectorla base de conocimiento, en tu servidor
  • Ollamael motor cuando el dato no puede salir
  • Twilio / WhatsApp Businessel canal donde ya te escriben
  • Langfuseresolución sin humano, motivo de escalado y satisfacción
  • Open Policy Agentlos límites de cada acción, escritos como regla

Cada una de estas piezas está catalogada en el stack, con lo importante: si se ejecuta dentro de tu empresa o si al meterla tu dato empieza a viajar.

Con qué motor lo movemos

Preferimos montarlo dentro de tu red, con un modelo abierto en tu propio servidor: es la única forma de que el dato no dependa de las condiciones de un tercero. Cuando eso no encaja — por presupuesto o porque no hace falta — trabajamos con modelos low cost adaptados a lo que puedas gastar, o con modelos frontera si la tarea lo pide. Para este servicio proponemos la capa marcada, pero se cambia sin rehacer el trabajo.

En tu servidor

Lo que proponemos aquí

El dato no sale. Es lo que preferimos.

Cuándo
Historiales, expedientes, nóminas, contratos, datos de salud, sector público — o cualquier cosa que no puedas explicar en una auditoría si acaba fuera.
Tu dato
No cruza el límite de tu empresa. Ni tu proveedor de nube ni nosotros vemos el contenido.
Cómo se paga
Inversión inicial en hardware y después coste plano: no sube aunque dupliques el uso.
  • LlamaMeta · pesos abiertos
  • QwenAlibaba · pesos abiertos
  • DeepSeekChina · pesos abiertos
  • MistralFrancia · pesos abiertos
  • GemmaGoogle · pesos abiertos
  • gpt-ossOpenAI · pesos abiertos

API de bajo coste

Potencia de sobra por céntimos.

Cuándo
Cuando el dato puede salir y lo que manda es el volumen: clasificar, extraer, traducir, resumir, etiquetar. Miles de operaciones al mes donde lo que cuenta es el precio por unidad.
Tu dato
Sale al proveedor que elijas. Te decimos cuál, en qué país están sus servidores y qué dicen sus condiciones de empresa sobre entrenar con lo que les mandas.
Cómo se paga
Céntimos por millón de palabras. Es la capa que hace viables los volúmenes grandes sin comprar una máquina.
  • Kimi K2Moonshot · China
  • DeepSeekChina
  • MistralFrancia · Europa
  • Gemini FlashGoogle · EE. UU.
  • GrokxAI · EE. UU.
  • GPT miniOpenAI · EE. UU.

Modelos frontera

Cuando el trabajo es difícil de verdad.

Cuándo
Razonamiento largo, código, análisis jurídico o financiero, agentes que encadenan veinte pasos sin que nadie mire. Donde una respuesta mediocre cuesta más de lo que cuesta el modelo.
Tu dato
Sale al proveedor. Leemos sus condiciones de empresa y te las resumimos por escrito antes de firmar nada.
Cómo se paga
El precio por palabra más alto del mercado — y a menudo el coste por tarea resuelta más bajo, porque acierta a la primera y no hay que revisarlo.
  • Claude Opus 5Anthropic · EE. UU.
  • GPT-5OpenAI · EE. UU.
  • Gemini ProGoogle · EE. UU.

En la práctica casi nunca es uno solo

Lo normal es enrutar: el modelo barato se come el 90% del volumen y solo lo que de verdad es difícil sube al modelo frontera. Si además hay dato sensible, esa parte se queda en el servidor local y nunca entra en el enrutado. Se factura la mezcla, no el modelo más caro — y ahí es donde una factura de IA se divide entre tres o entre diez.

Cómo elegimos el motor, en detalle →

Qué necesitamos de ti

  • Acceso de lectura al sistema donde vive el estado del pedido o del expediente
  • Las reglas reales de devolución, plazos y excepciones, aunque estén en la cabeza de alguien
  • Un responsable que decida qué puede hacer el asistente solo y qué no

Plazo típico: 5 a 9 semanas

Lo que sueles preguntarte

¿Cuánto tarda en estar funcionando?

5 a 9 semanas, contando desde que tenemos los accesos. El plazo exacto va en la propuesta, no lo dejamos abierto.

¿Salen mis datos de la empresa?

Depende de la arquitectura que elijas. El motor y la base de conocimiento pueden vivir dentro de tu red. Lo que sí sale, inevitablemente, es lo que viaja por el canal que uses: WhatsApp pasa por Meta, el correo por tu proveedor. Eso ya ocurre hoy sin IA, y lo dejamos escrito igual.

¿Con qué modelo de IA lo montáis?

Por defecto lo movemos con un modelo abierto en tu propio servidor, porque aquí el dato no debería salir. Si prefieres API, se cambia — y entonces te decimos exactamente qué sale. Preferimos la seguridad del dato y montar red y sistemas en local, pero trabajamos con las tres capas: modelos abiertos en tu propio servidor, LLM de bajo coste adaptados al presupuesto —chinos como Kimi K2 o DeepSeek, europeos como Mistral, estadounidenses como Gemini o Grok— y modelos frontera como Claude Opus 5 o GPT-5. El motor se cambia en la configuración sin rehacer el trabajo.

¿Cuánto tiene que funcionar para que me salga a cuenta?

Con liberar 8,7 horas a la semana, ya está pagado. En un caso típico libera unas 37 h al mes, por encima de ese listón. Los supuestos del cálculo están publicados en esta misma página, para que puedas discutirlos.

¿Qué necesitáis de mi parte?

Acceso de lectura al sistema donde vive el estado del pedido o del expediente; Las reglas reales de devolución, plazos y excepciones, aunque estén en la cabeza de alguien; Un responsable que decida qué puede hacer el asistente solo y qué no. Nada más: el resto del trabajo es nuestro.

¿Cuándo NO me conviene contratarlo?

Si recibes menos de 150 consultas al mes, el montaje no se paga: sale más barato que las conteste una persona. Y si tu producto es tan a medida que cada consulta es distinta, la IA aquí resta.

¿Puedo mantenerlo yo después, sin vosotros?

Sí. Todo lo que montamos se entrega documentado y con traspaso al equipo. No trabajamos con cajas negras.

¿Se va a inventar el estado de un pedido?

No puede, porque no lo genera: lo lee de tu sistema y lo cita. Cuando la consulta no tiene respuesta en los datos a los que tiene acceso, el asistente lo dice y escala. Preferimos que diga «no lo sé, te paso con alguien» a que rellene el hueco.

¿Puede tramitar una devolución sin que nadie lo revise?

Solo dentro de los límites que tú escribas: por ejemplo, hasta 80 €, dentro de los 14 días y sin incidencia previa. Todo lo que se salga de ahí pasa por una persona. Los límites están en la configuración, se cambian en un minuto y quedan registrados.

¿Mis clientes van a saber que hablan con una máquina?

Sí, y se lo decimos desde el primer mensaje. Ocultarlo es mala idea comercialmente y además el AI Act obliga a informarlo. Lo que sí evitamos es el teatro: nada de nombres humanos falsos ni de fingir que se está tecleando.

¿Encaja con lo que necesitas?

Cuéntanos el proceso concreto y te decimos si este servicio es el que te conviene — o cuál de los otros 48 lo es.