Cada plan combina alojamiento europeo aislado con los servicios gestionados que Hermes necesita alrededor: acceso a modelos, proxy seguro, controles de uso, canales, voz, datos persistentes, monitorización, actualizaciones probadas y soporte humano. Tú usas el agente; nosotros operamos la plataforma.
Las diferencias entre planes definen principalmente la capacidad del agente, los límites de uso y el nivel de soporte. La frecuencia de copias, el uso de modelos premium y otros complementos se muestran por separado.
Cada plan incluye la plataforma Hermes gestionada. Las diferencias entre planes definen tu capacidad de agente, límite de uso y nivel de soporte. Prueba gratuita de 15 días, sin tarjeta de crédito. Cancela cuando quieras.
Escala arriba o abajo cuando quieras desde tu dashboard. Los cambios se aplican en segundos — sin migración, sin downtime.
Las mismas tres capas — infraestructura, plataforma gestionada y operaciones — responden la mayoría de preguntas sobre qué pagas y en qué se diferencia de las alternativas.
No. Cada plan incluye un runtime aislado de Hermes más la plataforma gestionada y las operaciones descritas en la landing. Una VPS es solo la capa de infraestructura — te da CPU, memoria, disco y una IP, pero todavía tienes que desplegar Hermes, conectar modelos y canales, gestionar secretos, configurar TLS, añadir persistencia, establecer límites, monitorizar el estado, planificar actualizaciones y probar recuperación.
Hermes Haven le da a tu agente un servidor, los servicios de los que depende, y un equipo de operaciones responsable de mantener el stack soportado funcionando.
El precio mensual no se basa solo en RAM y CPU. También cubre:
Puedes construir estas piezas tú mismo en una VPS. Hermes Haven elimina ese trabajo de configuración y de operación continua — incluyendo cuando expiran certificados, cambian proveedores, se alcanzan límites, se llenan discos, o las releases introducen cambios de compatibilidad.
Sí. Hermes es código abierto. Auto-alojar significa que eres responsable del despliegue, integraciones, seguridad, monitorización, actualizaciones, copias y recuperación de incidentes. Hermes Haven opera el stack soportado por ti, y está diseñado para clientes que valoran un sistema listo y mantenido, y un responsable claro cuando algo falla.
Capacidad de agente (CPU, RAM, almacenamiento, número de agentes), acceso a la plataforma gestionada, límites de uso específicos del plan (créditos, peticiones), mantenimiento, y el nivel de soporte indicado. Los complementos como RAM extra, copias horarias o Haven Credits se facturan por separado y se muestran de forma transparente en esta página.
Qwen 3.6 35B está incluido gratis en cada plan, ejecutándose en nuestro cluster de GPUs europeo. Los modelos premium (GLM-5.2, GPT-5.5, Claude, y otros) están disponibles a través de Haven Credits prepagados. También puedes usar tus propias claves API para cualquier endpoint compatible con OpenAI — tus claves, tus modelos, tus reglas.
Cuando se agotan los Haven Credits, el agente cambia automáticamente al modelo Qwen incluido para que las conversaciones nunca se interrumpan.
Ves tu uso y saldo restante en el dashboard. Cuando agotas tus Base Credits, el agente te avisa y se pausa hasta el siguiente ciclo de facturación. Cuando se agotan los Haven Credits, las peticiones a modelos premium cambian automáticamente al modelo Qwen incluido. Puedes recargar Haven Credits o cambiar de plan en cualquier momento.
Los flujos de copia, restauración y recuperación gestionados están disponibles en cada plan. Las copias horarias están disponibles como complemento (10€/mes) para clientes que necesitan snapshots más frecuentes. La frecuencia base y retención de copias dependen de tu plan. Puedes gestionar y restaurar copias desde el dashboard.
Hermes Haven despliega y prueba las actualizaciones de Hermes y la plataforma. Tú controlas la configuración, personalidad, memoria y skills del agente — nosotros gestionamos el runtime alrededor. Las configuraciones de cliente que pueden romperse se evitan donde es posible, y se comunican cuando no.
Cada plan incluye soporte humano que conoce Hermes — personas que entienden el runtime de Hermes, el proxy, los modelos, los canales, el almacenamiento y los controles de la plataforma. Los canales y tiempos de respuesta varían por plan: email en Starter, email + chat en Plus, prioritario en Pro, y SLA 99.5% con soporte dedicado en Enterprise.
HeavenCredits (HC) es la moneda unificada para la inferencia de IA — 1€ = 1.000 HC. Los modelos se agrupan en 6 niveles de coste (L0–L5), desde gratis hasta ultra. Tu plan incluye HC mensuales; puedes recargar más cuando quieras.
Moneda unificada de la plataforma. 1€ = 1.000 HC, rate flat sin bonificaciones por volumen. Los HC del plan no se arrastran; las recargas nunca caducan.
| Plan | HC / mes |
|---|---|
| Trial | 0 |
| Starter (9€) | 1.500 |
| Plus (19€) | 6.000 |
| Pro (39€) | 20.000 |
| Enterprise (119€) | 50.000 |
Recarga: 10€ → 10.000 HC · 50€ → 50.000 HC · 100€ → 100.000 HC. Nunca caducan.
Modo economía: cuando se agotan los HC, solo modelos L0 (gratis) disponibles. Tu agente no se interrumpe.
BYOK: trae tus propias claves API = 0 HC consumidos. Pagas al proveedor directamente.
85 modelos en 6 niveles, medidos en HC por millón de tokens ponderados. L0 es gratis en nuestras GPUs; L1–L5 son modelos premium.
| Nivel | Rango HC/M | Descripción |
|---|---|---|
| L0 | 0 | Gratis (GPU propio) — 1 modelo |
| L1 | 1–500 | Económico — 5 modelos |
| L2 | 501–2.000 | Bajo coste — 11 modelos |
| L3 | 2.001–8.000 | Mid-range — 20 modelos |
| L4 | 8.001–20.000 | Premium — 10 modelos |
| L5 | 20.001+ | Ultra — 1 modelo |
Tokens ponderados:
ponderados = input_no_cacheado + (input_cacheado × 0,1) + (output × 5) + (razonamiento × 5)
Ejemplo: GLM-5.2 (L3, 5.138 HC/1M), 1.000 input + 500 output = 3.500 ponderados = 6 HC.
Prueba gratuita de 15 días. Sin tarjeta. Qwen 3.6 35B incluido.