Función Business y Enterprise

Escala hacia arriba cuando importa, escala hacia abajo cuando no

Configura umbrales de CPU y memoria una vez. sh0 agrega réplicas cuando la carga aumenta, las elimina cuando baja y balancea el tráfico automáticamente. Sin orquestador. Sin YAML. Sin alertas a las 3 AM.

Qué obtienes

Escalado basado en métricas, gestión de réplicas y balanceo de carga inteligente -- todo integrado.

Escalado basado en CPU
Escala réplicas hacia arriba o abajo según el uso promedio de CPU en los contenedores
Escalado basado en memoria
Activa eventos de escalado cuando el consumo de memoria cruza tus umbrales
Límites min/max de réplicas
Establece límites estrictos para que nunca sobre-escales ni sub-aprovisiones
Períodos de enfriamiento
Previene oscilaciones con períodos de enfriamiento configurables entre eventos de escalado
Balanceo de carga
Round-robin, menor cantidad de conexiones o distribución aleatoria entre réplicas
Enrutamiento consciente de salud
Solo enruta tráfico a réplicas saludables que pasan sus health checks

Cómo funciona

01

Configura umbrales de CPU/memoria

Define el porcentaje al que debe activarse el escalado -- por ejemplo, escalar arriba cuando la CPU supere el 70% o la memoria pase del 80%.

02

Define réplicas mín y máx

Establece el piso y techo para tu conteo de réplicas. El mínimo asegura disponibilidad; el máximo limita tu uso de recursos.

03

Configura el período de enfriamiento

Configura el tiempo mínimo entre eventos de escalado (por ejemplo, 60 segundos) para prevenir oscilación rápida bajo carga fluctuante.

04

sh0 escala automáticamente según la carga

El auto-escalador monitorea métricas continuamente y ajusta el conteo de réplicas en tiempo real. Sin intervención manual necesaria.

El pipeline de escalado

Pico de tráfico
Recolector de métricas
Umbral superado
Escalar réplicas
Balanceador de carga
Distribuir tráfico

Todo el ciclo se completa en segundos -- sin sobrecarga de orquestador, sin retrasos de programación de pods

Todo lo que necesitas

Umbrales de CPU y memoria

Configura umbrales independientes para la utilización de CPU y memoria. El escalado se activa cuando cualquier métrica cruza la línea.

Límites min/max de réplicas

Define un conteo mínimo de réplicas para alta disponibilidad y un máximo para controlar costos. sh0 se mantiene dentro de tus límites.

Enfriamiento configurable

Previene oscilaciones de escalado con una ventana de enfriamiento. Después de un evento de escalado, sh0 espera antes de evaluar nuevamente.

3 estrategias de balanceo de carga

Elige round-robin para distribución uniforme, menor cantidad de conexiones para enrutamiento inteligente o aleatorio para simplicidad. Cambia en cualquier momento.

Consciente de health checks

Las réplicas que fallan los health checks se eliminan automáticamente del pool del balanceador de carga. El tráfico solo llega a instancias saludables.

Capaz de escalar a cero

Configura réplicas mínimas en cero y sh0 apaga todas las instancias cuando están inactivas. Perfecto para staging, desarrollo y aplicaciones de bajo tráfico.

La forma tradicional

  • x Conectarse por SSH manualmente e iniciar contenedores
  • x Adivinar patrones de tráfico
  • x Sin respuesta automática a picos
  • x Sobre-aprovisionar para estar seguro
  • x Pagar por recursos inactivos
  • x Despertar a las 3 AM para escalar

La forma sh0

  • Configura umbrales una vez
  • Escalado automático hacia arriba con carga
  • Escala hacia abajo cuando hay calma
  • Balanceo de carga automático
  • Health checks enrutan el tráfico
  • Duerme tranquilo durante picos de tráfico

Preguntas y respuestas

¿Qué métricas activan el escalado? +
Utilización de CPU y uso de memoria, medidos como porcentaje en todas las réplicas en ejecución. Configuras el umbral para cada una independientemente -- por ejemplo, escalar arriba al 70% de CPU o 80% de memoria, lo que se alcance primero.
¿Qué tan rápido escala? +
Las nuevas réplicas se inician en segundos tras superar un umbral (sujeto a tu período de enfriamiento). Como sh0 usa imágenes Docker pre-compiladas, no hay paso de compilación -- los contenedores se inician inmediatamente desde la imagen existente.
¿Qué estrategias de balanceo de carga están disponibles? +
Tres estrategias: round-robin (solicitudes distribuidas uniformemente en orden), menor cantidad de conexiones (enviadas a la réplica con menos solicitudes activas) y aleatoria (distribuidas al azar). Puedes cambiar de estrategia en cualquier momento sin tiempo de inactividad.
¿Puedo configurar escala a cero? +
Sí. Configura tus réplicas mínimas en 0 y sh0 apagará todas las instancias cuando las métricas permanezcan por debajo del umbral. La primera solicitud entrante activa un arranque en frío. Ideal para entornos de staging o servicios de bajo tráfico.
¿Cómo funciona el enfriamiento? +
Después de un evento de escalado (arriba o abajo), sh0 espera el período de enfriamiento antes de evaluar métricas nuevamente. Esto previene la oscilación rápida cuando la carga fluctúa alrededor del umbral. El valor predeterminado es 60 segundos, configurable por aplicación.
¿Funciona con bases de datos? +
El auto-escalado está diseñado para contenedores de aplicación sin estado. Las bases de datos y otros servicios con estado no deben auto-escalarse -- sh0 te impide habilitarlo en contenedores de base de datos para proteger la integridad de los datos.

Maneja cualquier tráfico, automáticamente

Auto-escalado basado en CPU y memoria con balanceo de carga integrado. Sin orquestador necesario.