Je comprends la supervision et j'identifie les offres du marché
Savoir avant que l'utilisateur n'appelle
Le réseau DKTOYS, refondu au fil des cours précédents (VLAN, routage, sécurité, DHCP), est maintenant en service sur les sites de Dunkerque et de Reims. Reste une question : comment savoir qu'un commutateur sature, qu'une liaison entre les deux sites est tombée, ou qu'une imprimante de l'entrepôt n'a plus d'encre, avant que ce soit un utilisateur ou un client du site e-commerce qui vous l'apprenne par un ticket d'incident ? C'est le rôle de la supervision : observer en continu l'état du parc informatique et réseau, pour détecter une anomalie le plus tôt possible, idéalement avant qu'elle ne devienne visible pour l'utilisateur final.
Supervision proactive et supervision réactive
| Approche | Principe | Limite |
|---|---|---|
| Réactive | On découvre un problème quand un utilisateur signale une panne | Le temps de détection dépend de la rapidité du signalement ; l'incident a déjà un impact avant d'être connu |
| Proactive | Un outil de supervision interroge en continu les équipements et alerte dès qu'un seuil est franchi | Nécessite une mise en place initiale (sondes, seuils) et une maintenance de la configuration |
L'objectif d'un TSSR n'est pas de supprimer entièrement l'approche réactive (un utilisateur reste souvent le premier à percevoir un problème métier), mais de réduire le champ de ce qui reste réactif en couvrant par de la supervision proactive tout ce qui peut être mesuré techniquement : disponibilité d'un lien, charge d'un processeur, espace disque, niveau d'encre.
Les trois familles de ce que l'on supervise
| Famille | Exemples chez DKTOYS |
|---|---|
| Disponibilité | Un commutateur, un serveur ou une liaison Dunkerque-Reims répond-il ? |
| Performance | Charge CPU et mémoire d'un serveur, occupation de la bande passante d'une liaison, temps de réponse d'un service |
| Capacité et consommables | Espace disque restant, niveau d'encre ou de toner d'une imprimante, nombre de licences utilisées |
Une sonde de supervision (probe ou check) teste un point précis de l'une de ces familles, à intervalle régulier (polling), et compare le résultat à des seuils prédéfinis pour déterminer un état.
Les états d'une sonde
Une sonde de supervision retourne généralement l'un de ces quatre états, quel que soit l'outil utilisé :
| État | Signification |
|---|---|
| OK | La valeur mesurée est dans les limites normales |
| WARNING (avertissement) | La valeur a franchi un premier seuil, sans être encore critique — un signal à surveiller |
| CRITICAL (critique) | La valeur a franchi le seuil critique, une intervention est nécessaire |
| UNKNOWN (inconnu) | La sonde n'a pas pu obtenir de réponse (équipement injoignable, erreur de configuration de la sonde) |
Cette gradation à deux seuils (avertissement puis critique) permet de distinguer une dérive à surveiller — un disque qui se remplit progressivement — d'une urgence à traiter immédiatement — un lien réseau totalement coupé.
Les grandes familles d'offres du marché
| Solution | Modèle | Caractéristiques |
|---|---|---|
| Nagios | Open source | Historique et très répandu, fonctionne par plugins (scripts indépendants exécutant chaque type de sonde), configuration par fichiers texte |
| Centreon | Open source (avec offre commerciale) | S'appuie sur le moteur de Nagios (Centreon Engine), ajoute une interface web complète de configuration, cartographie et reporting |
| Zabbix | Open source | Supervision par agent installé sur chaque machine ou sans agent (SNMP), gestion native des seuils et des tendances |
| PRTG | Commercial | Facturé au nombre de sondes, installation rapide, interface unifiée, populaire en PME |
| Solutions cloud/SaaS | Commercial | Supervision hébergée par l'éditeur, sans serveur à maintenir en interne, mais dépendance à un tiers externe |
Ces outils partagent la même logique de fond décrite plus haut (hôtes, sondes, seuils, états, alertes) : le choix entre eux relève surtout de critères pratiques — budget, compétences déjà présentes dans l'équipe, taille du parc à superviser, préférence pour une solution hébergée en interne ou en mode SaaS. Pour DKTOYS, un outil open source de type Centreon ou Zabbix, hébergé sur le VLAN Supervision du site de Dunkerque, correspond au profil d'une PME qui maîtrise déjà l'administration Linux et Windows de son parc.
Polling et remontée événementielle
Un outil de supervision obtient ses informations de deux façons complémentaires, qui reviendront en détail dans les chapitres suivants de ce cours :
| Mode | Principe | Avantage | Limite |
|---|---|---|---|
| Polling (interrogation) | Le serveur de supervision interroge activement chaque équipement à intervalle régulier | Simple à mettre en œuvre, fonctionne même sur un équipement qui ne sait pas notifier de lui-même | Un incident survenu juste après une interrogation n'est détecté qu'au cycle suivant |
| Remontée événementielle | L'équipement supervisé prévient lui-même le serveur dès qu'un événement survient | Détection quasi immédiate d'un événement brutal | Nécessite que l'équipement sache émettre ce type de notification |
Ces deux mécanismes ne s'excluent pas : une supervision solide combine un polling régulier, qui donne une photographie périodique fiable de l'état du parc, et une remontée événementielle pour les incidents qui ne peuvent pas attendre le prochain cycle d'interrogation.
Cartographier le parc avant de superviser
La qualité d'une supervision dépend directement de la qualité de la cartographie du parc qui la précède. Pour DKTOYS, cela suppose de recenser, site par site, chaque équipement à intégrer à l'outil de supervision :
| Site | Équipements à superviser (exemples) |
|---|---|
| Dunkerque (siège) | Commutateurs de distribution et d'accès, routeur, pare-feu, serveurs (DHCP, applicatifs), imprimantes de l'entrepôt |
| Reims (succursale) | Commutateur local, liaison VPN vers Dunkerque, postes de travail critiques |
Cette cartographie sert de base à la déclaration des hôtes dans l'outil de supervision, étape préalable à toute création de sonde, détaillée au chapitre 3 de ce cours.
Ce que la supervision suppose déjà en place
Avant de créer la moindre sonde, deux prérequis conditionnent la qualité de la supervision :
- un inventaire à jour du parc à superviser (adresses IP, rôle de chaque équipement, criticité) ;
- une synchronisation horaire fiable entre le serveur de supervision et les équipements supervisés, pour que les horodatages des alertes et des journaux collectés (voir le chapitre sur le serveur Syslog) restent cohérents entre eux.
Le critère du coût, souvent décisif en PME
Au-delà des caractéristiques techniques, le modèle économique d'une solution de supervision pèse fortement dans le choix d'une entreprise de la taille de DKTOYS :
| Modèle | Principe | Implication |
|---|---|---|
| Open source auto-hébergé | Logiciel gratuit, coût limité à l'infrastructure et au temps d'administration | Maîtrise complète, mais nécessite une compétence interne pour l'installation, la configuration et le maintien à jour |
| Commercial sous licence | Facturation à la sonde, à l'hôte ou par palier | Support éditeur inclus, mise en route souvent plus rapide, coût récurrent à budgéter |
| SaaS (hébergé par l'éditeur) | Abonnement mensuel, aucune infrastructure à maintenir en interne | Simplicité de mise en œuvre, en contrepartie d'une dépendance à un prestataire externe et d'un flux de données de supervision qui transite par un tiers |
Pour DKTOYS, dont l'équipe technique maîtrise déjà l'administration Linux et Windows à l'issue des cours précédents, une solution open source auto-hébergée sur le VLAN Supervision reste cohérente avec les compétences déjà en place, sans coût de licence récurrent à justifier pour un parc de taille encore modeste.
Ce qu'il faut retenir
La supervision transforme la détection d'incident, d'un mécanisme réactif dépendant du signalement utilisateur, en un mécanisme proactif fondé sur des sondes interrogeant régulièrement les équipements du parc DKTOYS, chacune évaluée selon des seuils qui produisent un état (OK, WARNING, CRITICAL, UNKNOWN). Le marché propose plusieurs familles d'outils, open source (Nagios, Centreon, Zabbix) ou commerciales (PRTG, solutions SaaS), qui partagent cette même logique. Le protocole le plus couramment utilisé pour interroger à distance les équipements réseau, objet du chapitre suivant, est SNMP.
Note de production : aucun support dédié à la supervision réseau n'a été localisé dans les supports du dépôt à la date de rédaction ; ce chapitre s'appuie sur le cadrage pédagogique du module et sur des connaissances générales du marché de la supervision.