Fonctionnalité Pro et Business

Sachez avant vos utilisateurs

Métriques en temps réel, alertes instantanées, pages de statut publiques. sh0 surveille chaque conteneur pour que vous n'ayez pas à fixer des tableaux de bord toute la journée.

Ce qui est inclus

Chaque métrique importante pour les charges de travail en production, collectée automatiquement.

Métriques CPU
Utilisation CPU par conteneur avec tendances historiques
Métriques RAM
Consommation mémoire, limites et suivi OOM
E/S disque
Débit lecture/écriture et IOPS par volume
Trafic réseau
Bande passante entrante/sortante par conteneur
Santé du conteneur
Statut : en cours d'exécution, arrêté, en redémarrage, OOM-killed
Temps de réponse
Percentiles de latence HTTP (p50, p95, p99)

Comment ça fonctionne

01

Activer la supervision par application

Activez la supervision pour n'importe quelle application dans le tableau de bord. sh0 commence à collecter les métriques immédiatement -- aucun agent à installer, aucun fichier de configuration à écrire.

02

Définir les seuils d'alerte

Définissez quand vous souhaitez être notifié : CPU au-dessus de 90 %, RAM au-dessus de 80 %, temps de réponse au-dessus de 500 ms. Définissez par application ou des valeurs par défaut à l'échelle du serveur.

03

Choisir les canaux de notification

Routez les alertes vers Slack, Discord, Telegram, e-mail ou n'importe quel endpoint webhook. Différentes applications peuvent utiliser différents canaux.

04

Détendez-vous -- sh0 surveille 24h/24, 7j/7

Les métriques sont collectées toutes les 15 secondes. Les alertes se déclenchent dans la minute suivant un dépassement de seuil. Vous dormez, sh0 surveille.

Le pipeline de supervision

Conteneur d'application
Collecteur de métriques
Vérification des seuils
Routeur d'alertes
Slack / Discord / E-mail

Métriques collectées toutes les 15 secondes -- les alertes se déclenchent dans la minute suivant un dépassement

Tout ce dont vous avez besoin

Tableau de bord en temps réel

Graphiques CPU, RAM, disque et réseau en direct mis à jour toutes les 15 secondes. Zoomez sur n'importe quelle plage temporelle -- dernière heure, dernier jour, dernière semaine.

5 canaux d'alerte

Slack, Discord, Telegram, e-mail et webhooks génériques. Configurez une fois, routez les alertes par application ou par niveau de sévérité.

Vérifications de disponibilité

Health checks HTTP et TCP depuis votre serveur. Sachez quand une application tombe en panne avant que vos utilisateurs ne commencent à se plaindre.

Pages de statut publiques

Générez une page de statut publique pour vos services avec des indicateurs de disponibilité en temps réel. Partagez-la avec votre équipe ou vos clients.

Suivi des incidents

Chaque alerte crée un incident avec une chronologie : quand il a commencé, quand il a été pris en charge, quand il a été résolu. Piste d'audit complète.

Métriques historiques

Les métriques sont conservées pendant 30 jours (Pro) ou 90 jours (Business). Repérez les tendances, planifiez la capacité et déboguez les problèmes survenus mardi dernier.

L'ancienne méthode

  • x Installer Prometheus + Grafana
  • x Configurer les exporters par service
  • x Écrire les règles d'alerte en YAML
  • x Mettre en place Alertmanager
  • x Maintenir une page de statut séparée
  • x Espérer que rien ne casse à 3 h du matin

La méthode sh0

  • Activer la supervision par application
  • Définir les seuils dans le tableau de bord
  • 5 canaux intégrés
  • Pages de statut incluses
  • Chronologie des incidents automatique
  • Dormez tranquille

Questions et réponses

Quelles métriques sont collectées ? +
Utilisation CPU, consommation mémoire, E/S disque, trafic réseau, statut de santé du conteneur et temps de réponse HTTP. Toutes les métriques sont collectées par conteneur, pour que vous puissiez voir exactement quelle application consomme des ressources.
À quelle fréquence les métriques sont-elles collectées ? +
Toutes les 15 secondes par défaut. Les alertes sont évaluées à chaque cycle de collecte, vous êtes donc notifié dans la minute suivant le dépassement d'un seuil.
Puis-je définir des seuils personnalisés ? +
Oui. Chaque métrique prend en charge des seuils personnalisés par application. Par exemple, votre serveur API peut alerter à 80 % de CPU tandis que votre worker en arrière-plan peut fonctionner à 95 % en toute sécurité. Vous pouvez également définir des valeurs par défaut à l'échelle du serveur.
Y a-t-il une page de statut publique ? +
Oui. sh0 peut générer une page de statut publique montrant la disponibilité de vos services sélectionnés. Vous obtenez une URL partageable qui affiche le statut en temps réel et l'historique des incidents -- sans outils externes nécessaires.
Comment fonctionnent les canaux d'alerte ? +
Vous configurez les canaux une fois dans le tableau de bord (par ex., une URL webhook Slack, un canal Discord, une adresse e-mail). Ensuite, vous assignez les canaux aux applications ou aux règles d'alerte. Lorsqu'un seuil est dépassé, sh0 envoie des notifications à tous les canaux assignés.
La supervision affecte-t-elle les performances ? +
Impact négligeable. sh0 lit les métriques depuis l'API Docker stats et le système de fichiers Linux /proc -- aucun agent ne s'exécute dans vos conteneurs. La surcharge est inférieure à 1 % de CPU et quelques mégaoctets de RAM.

Arrêtez de naviguer à l'aveugle

Métriques en temps réel, alertes instantanées, zéro configuration. Sachez exactement ce qui se passe sur votre serveur.