serviciosia

Hermes Agent autoalojado

Un agente que aprende tus procedimientos y guarda lo aprendido en tu servidor

se queda dentro
Hermes Agent autoalojado — servicio SRV-13 de serviciosia, nivel de agentes y mcp: el dato se queda dentro de tu empresa.
Hermes Agent autoalojado — servicio SRV-13 de serviciosia, nivel de agentes y mcp: el dato se queda dentro de tu empresa.

Con liberar 5,0 horas a la semana, ya está pagado.

Las suscripciones de IA se consumen: pagas cada mes y cada mes empiezas de cero. El conocimiento que el sistema acumula sobre tu forma concreta de trabajar se queda en casa del proveedor, y el día que te vas, no se va contigo nada.

Qué hacemos

Hermes Agent es un agente autoalojado de Nous Research, con licencia MIT y sin telemetría, que corre entero en tu servidor. Nosotros lo desplegamos, lo conectamos a tus sistemas y lo dejamos operativo con la documentación para que puedas mantenerlo sin nosotros.

Lo que lo hace distinto es el ciclo de aprendizaje cerrado: cuando termina una tarea compleja, el propio agente redacta un documento con el procedimiento que ha seguido, los fallos con los que se ha encontrado y cómo verificar que el resultado es correcto. Esa nota queda en tu disco y la usa la próxima vez.

La consecuencia práctica importa más que la técnica: el activo se revaloriza. A los seis meses el agente no sabe lo mismo que el primer día, sabe cómo se hacen las cosas en tu empresa. Y eso está en tu servidor, no en el de nadie más.

Trae además un planificador de tareas propio, así que los informes recurrentes, las comprobaciones periódicas y los resúmenes salen solos y llegan a Telegram, Slack o correo sin montar nada por encima.

Cómo funciona

Diagrama de funcionamiento de Hermes Agent autoalojado: el dato entra desde tus sistemas, se procesa dentro de tu red y el resultado vuelve sin cruzar el límite.TU EMPRESATus sistemastus sistemasentraMotor en tu servidorHermes Agent autoalojadodevuelve el resultado a tu sistemaTu equiporevisa y decideno cruza el límite
Todo el recorrido ocurre dentro de tu red: entra desde tus sistemas, se procesa en tu servidor y vuelve. Ni tu proveedor de nube ni nosotros vemos el contenido.

Dónde vive el dato

Diagrama: el dato se procesa dentro de tu red y no cruza el límite en ningún momento.TU EMPRESALÍMITEDocumentosModelono cruza
Todo el recorrido ocurre dentro de tu red. Ni tu proveedor de nube ni nosotros vemos el contenido.

Retorno de la inversión

Con liberar 5,0 horas a la semana, ya está pagado.

En un caso típico libera unas 38 h al mes, por encima de ese listón.

Curva de amortización: lo ahorrado supera a lo invertido en el mes 6, y a partir de ahí el servicio deja de costar dinero.mes 6 · ya está pagadolo que llevas invertidolo que llevas ahorradohoy24 meses34.292 €0 €
Las dos líneas se cruzan en el mes 6. A partir de ahí la franja verde es dinero que te queda, no que gastas — y a los 24 meses son 19.972 €.
Coste actual del proceso
3150 € /mes
Horas liberadas al mes
38 h
Inversión de implantación
6500 €
Operación
220 € /mes
Ahorro neto
1103 € /mes
Punto de equilibrio
6 meses
Resultado a 12 meses
6736 €
Supuestos de este cálculo (4)
  • La licencia MIT no añade coste: la operación es servidor, inferencia y mantenimiento
  • El 60% sube con el tiempo por el ciclo de aprendizaje, pero se calcula con el valor del primer año
  • Factor de realismo del 70% aplicado sobre la parte automatizable
  • No se contabiliza el valor del conocimiento acumulado, que es real pero no se puede facturar honestamente por adelantado

Qué incluye

  • Despliegue en tu servidor con arranque automático y actualizaciones controladas
  • Conexión al canal de mensajería que uséis
  • Configuración de tareas programadas
  • Definición del espacio de aprendizaje y de qué puede y no puede escribir
  • Documentación y traspaso: repositorio, runbook y dos sesiones

Con qué lo montamos

No trabajamos con una sola herramienta ni te casamos con ninguna. Esto es lo que solemos usar para este servicio y para qué sirve cada pieza — si ya tienes algo montado, partimos de ahí.

  • Hermes Agentel runtime, con licencia MIT y sin telemetría
  • Ollamael modelo servido en tu máquina
  • PostgreSQL + pgvectorla memoria larga de lo aprendido
  • Redismemoria de sesión y colas
  • Dockerarranque automático y actualizaciones controladas
  • Telegram / Slackdonde el agente entrega y avisa

Cada una de estas piezas está catalogada en el stack, con lo importante: si se ejecuta dentro de tu empresa o si al meterla tu dato empieza a viajar.

Con qué motor lo movemos

Preferimos montarlo dentro de tu red, con un modelo abierto en tu propio servidor: es la única forma de que el dato no dependa de las condiciones de un tercero. Cuando eso no encaja — por presupuesto o porque no hace falta — trabajamos con modelos low cost adaptados a lo que puedas gastar, o con modelos frontera si la tarea lo pide. Para este servicio proponemos la capa marcada, pero se cambia sin rehacer el trabajo.

En tu servidor

Lo que proponemos aquí

El dato no sale. Es lo que preferimos.

Cuándo
Historiales, expedientes, nóminas, contratos, datos de salud, sector público — o cualquier cosa que no puedas explicar en una auditoría si acaba fuera.
Tu dato
No cruza el límite de tu empresa. Ni tu proveedor de nube ni nosotros vemos el contenido.
Cómo se paga
Inversión inicial en hardware y después coste plano: no sube aunque dupliques el uso.
  • LlamaMeta · pesos abiertos
  • QwenAlibaba · pesos abiertos
  • DeepSeekChina · pesos abiertos
  • MistralFrancia · pesos abiertos
  • GemmaGoogle · pesos abiertos
  • gpt-ossOpenAI · pesos abiertos

API de bajo coste

Potencia de sobra por céntimos.

Cuándo
Cuando el dato puede salir y lo que manda es el volumen: clasificar, extraer, traducir, resumir, etiquetar. Miles de operaciones al mes donde lo que cuenta es el precio por unidad.
Tu dato
Sale al proveedor que elijas. Te decimos cuál, en qué país están sus servidores y qué dicen sus condiciones de empresa sobre entrenar con lo que les mandas.
Cómo se paga
Céntimos por millón de palabras. Es la capa que hace viables los volúmenes grandes sin comprar una máquina.
  • Kimi K2Moonshot · China
  • DeepSeekChina
  • MistralFrancia · Europa
  • Gemini FlashGoogle · EE. UU.
  • GrokxAI · EE. UU.
  • GPT miniOpenAI · EE. UU.

Modelos frontera

Cuando el trabajo es difícil de verdad.

Cuándo
Razonamiento largo, código, análisis jurídico o financiero, agentes que encadenan veinte pasos sin que nadie mire. Donde una respuesta mediocre cuesta más de lo que cuesta el modelo.
Tu dato
Sale al proveedor. Leemos sus condiciones de empresa y te las resumimos por escrito antes de firmar nada.
Cómo se paga
El precio por palabra más alto del mercado — y a menudo el coste por tarea resuelta más bajo, porque acierta a la primera y no hay que revisarlo.
  • Claude Opus 5Anthropic · EE. UU.
  • GPT-5OpenAI · EE. UU.
  • Gemini ProGoogle · EE. UU.

En la práctica casi nunca es uno solo

Lo normal es enrutar: el modelo barato se come el 90% del volumen y solo lo que de verdad es difícil sube al modelo frontera. Si además hay dato sensible, esa parte se queda en el servidor local y nunca entra en el enrutado. Se factura la mezcla, no el modelo más caro — y ahí es donde una factura de IA se divide entre tres o entre diez.

Cómo elegimos el motor, en detalle →

Qué necesitamos de ti

  • Un servidor accesible, o lo dimensionamos y montamos nosotros
  • Los procesos que quieres que asuma, con sus excepciones
  • Credenciales de los sistemas con los que debe hablar

Plazo típico: 2 a 5 semanas

Lo que sueles preguntarte

¿Cuánto tarda en estar funcionando?

2 a 5 semanas, contando desde que tenemos los accesos. El plazo exacto va en la propuesta, no lo dejamos abierto.

¿Salen mis datos de la empresa?

No. Todo el procesado ocurre dentro de tu red y ni tu proveedor de nube ni nosotros vemos el contenido.

¿Con qué modelo de IA lo montáis?

Por defecto lo movemos con un modelo abierto en tu propio servidor, porque aquí el dato no debería salir. Si prefieres API, se cambia — y entonces te decimos exactamente qué sale. Preferimos la seguridad del dato y montar red y sistemas en local, pero trabajamos con las tres capas: modelos abiertos en tu propio servidor, LLM de bajo coste adaptados al presupuesto —chinos como Kimi K2 o DeepSeek, europeos como Mistral, estadounidenses como Gemini o Grok— y modelos frontera como Claude Opus 5 o GPT-5. El motor se cambia en la configuración sin rehacer el trabajo.

¿Cuánto tiene que funcionar para que me salga a cuenta?

Con liberar 5,0 horas a la semana, ya está pagado. En un caso típico libera unas 38 h al mes, por encima de ese listón. Los supuestos del cálculo están publicados en esta misma página, para que puedas discutirlos.

¿Qué necesitáis de mi parte?

Un servidor accesible, o lo dimensionamos y montamos nosotros; Los procesos que quieres que asuma, con sus excepciones; Credenciales de los sistemas con los que debe hablar. Nada más: el resto del trabajo es nuestro.

¿Cuándo NO me conviene contratarlo?

Si nadie de tu equipo va a revisar lo que el agente aprende, el ciclo de aprendizaje se vuelve en tu contra: fija procedimientos equivocados con la misma diligencia que los buenos. Necesita un responsable, aunque sea una hora al mes.

¿Puedo mantenerlo yo después, sin vosotros?

Sí. Todo lo que montamos se entrega documentado y con traspaso al equipo. No trabajamos con cajas negras.

¿Encaja con lo que necesitas?

Cuéntanos el proceso concreto y te decimos si este servicio es el que te conviene — o cuál de los otros 48 lo es.