Escale quando importa, reduza quando não importa
Defina limites de CPU e memória uma vez. sh0 adiciona réplicas quando a carga aumenta, remove quando diminui e faz load balance do tráfego automaticamente. Sem orquestrador. Sem YAML. Sem alertas às 3h da manhã.
O que você recebe
Escala baseada em métricas, gerenciamento de réplicas e load balancing inteligente -- tudo integrado.
Como funciona
Defina limites de CPU/memória
Defina a porcentagem em que a escala deve ser disparada -- por exemplo, escale para cima quando a CPU exceder 70% ou a memória passar de 80%.
Defina mín e máx de réplicas
Defina o piso e o teto para a contagem de réplicas. Mínimo garante disponibilidade; máximo limita o uso de recursos.
Configure o período de cooldown
Defina o tempo mínimo entre eventos de escala (ex.: 60 segundos) para prevenir oscilação rápida sob carga flutuante.
sh0 escala automaticamente baseado na carga
O autoscaler monitora métricas continuamente e ajusta a contagem de réplicas em tempo real. Sem intervenção manual necessária.
O pipeline de escala
Todo o ciclo completa em segundos -- sem overhead de orquestrador, sem atrasos de agendamento de pod
Tudo o que você precisa
Limites de CPU e memória
Defina limites independentes para utilização de CPU e memória. A escala é disparada quando qualquer métrica ultrapassa a linha.
Limites mín/máx de réplicas
Defina uma contagem mínima de réplicas para alta disponibilidade e uma máxima para controlar custos. sh0 fica dentro dos seus limites.
Cooldown configurável
Previna oscilação de escala com uma janela de cooldown. Após um evento de escala, sh0 aguarda antes de avaliar novamente.
3 estratégias de load balancing
Escolha round-robin para distribuição uniforme, least-connections para roteamento inteligente ou random para simplicidade. Troque a qualquer momento.
Consciente de health-check
Réplicas que falham nos health checks são automaticamente removidas do pool do load balancer. O tráfego só vai para instâncias saudáveis.
Capaz de scale-to-zero
Defina réplicas mínimas como zero e sh0 desliga todas as instâncias quando ociosas. Perfeito para staging, dev e apps com pouco tráfego.
O jeito antigo
- x SSH manual e iniciar containers
- x Adivinhar padrões de tráfego
- x Sem resposta automática a picos
- x Superprovisionar para garantir
- x Pagar por recursos ociosos
- x Acordar às 3h da manhã para escalar
O jeito sh0
- Defina limites uma vez
- Escala automática para cima sob carga
- Escala para baixo quando calmo
- Load balanced automaticamente
- Health checks roteiam tráfego
- Durma durante picos de tráfego
Perguntas e respostas
Quais métricas disparam a escala? +
Quão rápido é a escala? +
Quais estratégias de load balancing estão disponíveis? +
Posso definir scale-to-zero? +
Como funciona o cooldown? +
Funciona com bancos de dados? +
Lide com qualquer tráfego, automaticamente
Auto-scaling baseado em CPU e memória com load balancing integrado. Sem orquestrador necessário.