Fonctionnalité Business et Enterprise

Monter en charge quand c'est nécessaire, réduire quand ça ne l'est pas

Définissez les seuils CPU et mémoire une fois. sh0 ajoute des réplicas quand la charge augmente, les supprime quand elle baisse, et équilibre le trafic automatiquement. Pas d'orchestrateur. Pas de YAML. Pas d'alertes à 3 h du matin.

Ce que vous obtenez

Mise à l'échelle pilotée par les métriques, gestion des réplicas et équilibrage de charge intelligent -- le tout intégré.

Mise à l'échelle basée sur le CPU
Augmentez ou diminuez les réplicas en fonction de l'utilisation CPU moyenne à travers les conteneurs
Mise à l'échelle basée sur la mémoire
Déclenchez des événements de mise à l'échelle quand la consommation mémoire dépasse vos seuils
Limites min/max de réplicas
Définissez des limites strictes pour ne jamais sur-dimensionner ou sous-provisionner
Périodes de refroidissement
Évitez les oscillations avec un délai de refroidissement configurable entre les événements de mise à l'échelle
Équilibrage de charge
Distribution round-robin, least-connections ou aléatoire à travers les réplicas
Routage tenant compte de la santé
Routez le trafic uniquement vers les réplicas sains qui passent leurs health checks

Comment ça fonctionne

01

Définir les seuils CPU/mémoire

Définissez le pourcentage auquel la mise à l'échelle doit se déclencher -- par exemple, monter en charge quand le CPU dépasse 70 % ou la mémoire dépasse 80 %.

02

Définir le min et max de réplicas

Définissez le plancher et le plafond de votre nombre de réplicas. Le minimum assure la disponibilité ; le maximum plafonne votre utilisation de ressources.

03

Configurer la période de refroidissement

Définissez le temps minimum entre les événements de mise à l'échelle (par ex., 60 secondes) pour éviter les oscillations rapides sous une charge fluctuante.

04

sh0 met à l'échelle automatiquement en fonction de la charge

L'autoscaler surveille les métriques en continu et ajuste le nombre de réplicas en temps réel. Aucune intervention manuelle nécessaire.

Le pipeline de mise à l'échelle

Pic de trafic
Collecteur de métriques
Seuil dépassé
Augmenter les réplicas
Équilibreur de charge
Distribuer le trafic

Le cycle complet s'effectue en quelques secondes -- pas de surcharge d'orchestrateur, pas de délais de planification de pods

Tout ce dont vous avez besoin

Seuils CPU et mémoire

Définissez des seuils indépendants pour l'utilisation CPU et mémoire. La mise à l'échelle se déclenche quand l'une des métriques dépasse la ligne.

Limites min/max de réplicas

Définissez un nombre minimum de réplicas pour la haute disponibilité et un maximum pour contrôler les coûts. sh0 reste dans vos limites.

Refroidissement configurable

Évitez les oscillations de mise à l'échelle avec une fenêtre de refroidissement. Après un événement de mise à l'échelle, sh0 attend avant d'évaluer à nouveau.

3 stratégies d'équilibrage de charge

Choisissez round-robin pour une distribution uniforme, least-connections pour un routage intelligent, ou random pour la simplicité. Changez à tout moment.

Tenant compte des health checks

Les réplicas qui échouent aux health checks sont automatiquement retirés du pool de l'équilibreur de charge. Le trafic n'atteint que les instances saines.

Capable de mise à l'échelle vers zéro

Définissez le minimum de réplicas à zéro et sh0 arrête toutes les instances quand elles sont inactives. Parfait pour le staging, le dev et les applications à faible trafic.

L'ancienne méthode

  • x Se connecter en SSH et démarrer les conteneurs manuellement
  • x Deviner les schémas de trafic
  • x Pas de réponse automatique aux pics
  • x Sur-provisionner pour être tranquille
  • x Payer pour des ressources inactives
  • x Se réveiller à 3 h du matin pour monter en charge

La méthode sh0

  • Définir les seuils une fois
  • Montée en charge automatique sous charge
  • Réduction automatique quand c'est calme
  • Équilibrage de charge automatique
  • Les health checks routent le trafic
  • Dormez pendant les pics de trafic

Questions et réponses

Quelles métriques déclenchent la mise à l'échelle ? +
L'utilisation CPU et la consommation mémoire, mesurées en pourcentage à travers tous les réplicas en cours d'exécution. Vous définissez le seuil pour chaque métrique indépendamment -- par exemple, monter en charge à 70 % de CPU ou 80 % de mémoire, selon ce qui est atteint en premier.
Quelle est la rapidité de la mise à l'échelle ? +
Les nouveaux réplicas sont démarrés en quelques secondes après un dépassement de seuil (sous réserve de votre période de refroidissement). Comme sh0 utilise des images Docker pré-construites, il n'y a pas d'étape de build -- les conteneurs démarrent immédiatement à partir de l'image existante.
Quelles stratégies d'équilibrage de charge sont disponibles ? +
Trois stratégies : round-robin (requêtes distribuées uniformément dans l'ordre), least-connections (envoyées au réplica gérant le moins de requêtes actives) et random (distribuées aléatoirement). Vous pouvez changer de stratégie à tout moment sans temps d'arrêt.
Puis-je configurer la mise à l'échelle vers zéro ? +
Oui. Définissez votre minimum de réplicas à 0 et sh0 arrêtera toutes les instances quand les métriques restent en dessous du seuil. La première requête entrante déclenche un démarrage à froid. Idéal pour les environnements de staging ou les services à faible trafic.
Comment fonctionne le refroidissement ? +
Après un événement de mise à l'échelle (à la hausse ou à la baisse), sh0 attend la période de refroidissement avant d'évaluer à nouveau les métriques. Cela empêche les oscillations rapides quand la charge fluctue autour du seuil. Par défaut 60 secondes, configurable par application.
Est-ce que cela fonctionne avec les bases de données ? +
L'auto-scaling est conçu pour les conteneurs d'application sans état. Les bases de données et autres services avec état ne doivent pas être mis à l'échelle automatiquement -- sh0 vous empêche de l'activer sur les conteneurs de base de données pour protéger l'intégrité des données.

Gérez n'importe quel trafic, automatiquement

Auto-scaling basé sur le CPU et la mémoire avec équilibrage de charge intégré. Aucun orchestrateur requis.