Monter en charge quand c'est nécessaire, réduire quand ça ne l'est pas
Définissez les seuils CPU et mémoire une fois. sh0 ajoute des réplicas quand la charge augmente, les supprime quand elle baisse, et équilibre le trafic automatiquement. Pas d'orchestrateur. Pas de YAML. Pas d'alertes à 3 h du matin.
Ce que vous obtenez
Mise à l'échelle pilotée par les métriques, gestion des réplicas et équilibrage de charge intelligent -- le tout intégré.
Comment ça fonctionne
Définir les seuils CPU/mémoire
Définissez le pourcentage auquel la mise à l'échelle doit se déclencher -- par exemple, monter en charge quand le CPU dépasse 70 % ou la mémoire dépasse 80 %.
Définir le min et max de réplicas
Définissez le plancher et le plafond de votre nombre de réplicas. Le minimum assure la disponibilité ; le maximum plafonne votre utilisation de ressources.
Configurer la période de refroidissement
Définissez le temps minimum entre les événements de mise à l'échelle (par ex., 60 secondes) pour éviter les oscillations rapides sous une charge fluctuante.
sh0 met à l'échelle automatiquement en fonction de la charge
L'autoscaler surveille les métriques en continu et ajuste le nombre de réplicas en temps réel. Aucune intervention manuelle nécessaire.
Le pipeline de mise à l'échelle
Le cycle complet s'effectue en quelques secondes -- pas de surcharge d'orchestrateur, pas de délais de planification de pods
Tout ce dont vous avez besoin
Seuils CPU et mémoire
Définissez des seuils indépendants pour l'utilisation CPU et mémoire. La mise à l'échelle se déclenche quand l'une des métriques dépasse la ligne.
Limites min/max de réplicas
Définissez un nombre minimum de réplicas pour la haute disponibilité et un maximum pour contrôler les coûts. sh0 reste dans vos limites.
Refroidissement configurable
Évitez les oscillations de mise à l'échelle avec une fenêtre de refroidissement. Après un événement de mise à l'échelle, sh0 attend avant d'évaluer à nouveau.
3 stratégies d'équilibrage de charge
Choisissez round-robin pour une distribution uniforme, least-connections pour un routage intelligent, ou random pour la simplicité. Changez à tout moment.
Tenant compte des health checks
Les réplicas qui échouent aux health checks sont automatiquement retirés du pool de l'équilibreur de charge. Le trafic n'atteint que les instances saines.
Capable de mise à l'échelle vers zéro
Définissez le minimum de réplicas à zéro et sh0 arrête toutes les instances quand elles sont inactives. Parfait pour le staging, le dev et les applications à faible trafic.
L'ancienne méthode
- x Se connecter en SSH et démarrer les conteneurs manuellement
- x Deviner les schémas de trafic
- x Pas de réponse automatique aux pics
- x Sur-provisionner pour être tranquille
- x Payer pour des ressources inactives
- x Se réveiller à 3 h du matin pour monter en charge
La méthode sh0
- Définir les seuils une fois
- Montée en charge automatique sous charge
- Réduction automatique quand c'est calme
- Équilibrage de charge automatique
- Les health checks routent le trafic
- Dormez pendant les pics de trafic
Questions et réponses
Quelles métriques déclenchent la mise à l'échelle ? +
Quelle est la rapidité de la mise à l'échelle ? +
Quelles stratégies d'équilibrage de charge sont disponibles ? +
Puis-je configurer la mise à l'échelle vers zéro ? +
Comment fonctionne le refroidissement ? +
Est-ce que cela fonctionne avec les bases de données ? +
Gérez n'importe quel trafic, automatiquement
Auto-scaling basé sur le CPU et la mémoire avec équilibrage de charge intégré. Aucun orchestrateur requis.