Infrastructure réseau

Superviser le réseau

Mettez en place une solution de supervision pour être informé en temps réel de l'état du parc. Renseignez-vous sur SNMP (MIB, OID), créez des sondes pour tester les organes vitaux des équipements, configurez des alertes mail et centralisez les logs sur un serveur Syslog.

Je comprends la supervision et j'identifie les offres du marché

Savoir avant que l'utilisateur n'appelle

Le réseau DKTOYS, refondu au fil des cours précédents (VLAN, routage, sécurité, DHCP), est maintenant en service sur les sites de Dunkerque et de Reims. Reste une question : comment savoir qu'un commutateur sature, qu'une liaison entre les deux sites est tombée, ou qu'une imprimante de l'entrepôt n'a plus d'encre, avant que ce soit un utilisateur ou un client du site e-commerce qui vous l'apprenne par un ticket d'incident ? C'est le rôle de la supervision : observer en continu l'état du parc informatique et réseau, pour détecter une anomalie le plus tôt possible, idéalement avant qu'elle ne devienne visible pour l'utilisateur final.

Supervision proactive et supervision réactive

ApprochePrincipeLimite
RéactiveOn découvre un problème quand un utilisateur signale une panneLe temps de détection dépend de la rapidité du signalement ; l'incident a déjà un impact avant d'être connu
ProactiveUn outil de supervision interroge en continu les équipements et alerte dès qu'un seuil est franchiNécessite une mise en place initiale (sondes, seuils) et une maintenance de la configuration

L'objectif d'un TSSR n'est pas de supprimer entièrement l'approche réactive (un utilisateur reste souvent le premier à percevoir un problème métier), mais de réduire le champ de ce qui reste réactif en couvrant par de la supervision proactive tout ce qui peut être mesuré techniquement : disponibilité d'un lien, charge d'un processeur, espace disque, niveau d'encre.

Les trois familles de ce que l'on supervise

FamilleExemples chez DKTOYS
DisponibilitéUn commutateur, un serveur ou une liaison Dunkerque-Reims répond-il ?
PerformanceCharge CPU et mémoire d'un serveur, occupation de la bande passante d'une liaison, temps de réponse d'un service
Capacité et consommablesEspace disque restant, niveau d'encre ou de toner d'une imprimante, nombre de licences utilisées

Une sonde de supervision (probe ou check) teste un point précis de l'une de ces familles, à intervalle régulier (polling), et compare le résultat à des seuils prédéfinis pour déterminer un état.

Les états d'une sonde

Une sonde de supervision retourne généralement l'un de ces quatre états, quel que soit l'outil utilisé :

ÉtatSignification
OKLa valeur mesurée est dans les limites normales
WARNING (avertissement)La valeur a franchi un premier seuil, sans être encore critique — un signal à surveiller
CRITICAL (critique)La valeur a franchi le seuil critique, une intervention est nécessaire
UNKNOWN (inconnu)La sonde n'a pas pu obtenir de réponse (équipement injoignable, erreur de configuration de la sonde)

Cette gradation à deux seuils (avertissement puis critique) permet de distinguer une dérive à surveiller — un disque qui se remplit progressivement — d'une urgence à traiter immédiatement — un lien réseau totalement coupé.

Les grandes familles d'offres du marché

SolutionModèleCaractéristiques
NagiosOpen sourceHistorique et très répandu, fonctionne par plugins (scripts indépendants exécutant chaque type de sonde), configuration par fichiers texte
CentreonOpen source (avec offre commerciale)S'appuie sur le moteur de Nagios (Centreon Engine), ajoute une interface web complète de configuration, cartographie et reporting
ZabbixOpen sourceSupervision par agent installé sur chaque machine ou sans agent (SNMP), gestion native des seuils et des tendances
PRTGCommercialFacturé au nombre de sondes, installation rapide, interface unifiée, populaire en PME
Solutions cloud/SaaSCommercialSupervision hébergée par l'éditeur, sans serveur à maintenir en interne, mais dépendance à un tiers externe

Ces outils partagent la même logique de fond décrite plus haut (hôtes, sondes, seuils, états, alertes) : le choix entre eux relève surtout de critères pratiques — budget, compétences déjà présentes dans l'équipe, taille du parc à superviser, préférence pour une solution hébergée en interne ou en mode SaaS. Pour DKTOYS, un outil open source de type Centreon ou Zabbix, hébergé sur le VLAN Supervision du site de Dunkerque, correspond au profil d'une PME qui maîtrise déjà l'administration Linux et Windows de son parc.

Polling et remontée événementielle

Un outil de supervision obtient ses informations de deux façons complémentaires, qui reviendront en détail dans les chapitres suivants de ce cours :

ModePrincipeAvantageLimite
Polling (interrogation)Le serveur de supervision interroge activement chaque équipement à intervalle régulierSimple à mettre en œuvre, fonctionne même sur un équipement qui ne sait pas notifier de lui-mêmeUn incident survenu juste après une interrogation n'est détecté qu'au cycle suivant
Remontée événementielleL'équipement supervisé prévient lui-même le serveur dès qu'un événement survientDétection quasi immédiate d'un événement brutalNécessite que l'équipement sache émettre ce type de notification

Ces deux mécanismes ne s'excluent pas : une supervision solide combine un polling régulier, qui donne une photographie périodique fiable de l'état du parc, et une remontée événementielle pour les incidents qui ne peuvent pas attendre le prochain cycle d'interrogation.

Cartographier le parc avant de superviser

La qualité d'une supervision dépend directement de la qualité de la cartographie du parc qui la précède. Pour DKTOYS, cela suppose de recenser, site par site, chaque équipement à intégrer à l'outil de supervision :

SiteÉquipements à superviser (exemples)
Dunkerque (siège)Commutateurs de distribution et d'accès, routeur, pare-feu, serveurs (DHCP, applicatifs), imprimantes de l'entrepôt
Reims (succursale)Commutateur local, liaison VPN vers Dunkerque, postes de travail critiques

Cette cartographie sert de base à la déclaration des hôtes dans l'outil de supervision, étape préalable à toute création de sonde, détaillée au chapitre 3 de ce cours.

Ce que la supervision suppose déjà en place

Avant de créer la moindre sonde, deux prérequis conditionnent la qualité de la supervision :

  • un inventaire à jour du parc à superviser (adresses IP, rôle de chaque équipement, criticité) ;
  • une synchronisation horaire fiable entre le serveur de supervision et les équipements supervisés, pour que les horodatages des alertes et des journaux collectés (voir le chapitre sur le serveur Syslog) restent cohérents entre eux.

Le critère du coût, souvent décisif en PME

Au-delà des caractéristiques techniques, le modèle économique d'une solution de supervision pèse fortement dans le choix d'une entreprise de la taille de DKTOYS :

ModèlePrincipeImplication
Open source auto-hébergéLogiciel gratuit, coût limité à l'infrastructure et au temps d'administrationMaîtrise complète, mais nécessite une compétence interne pour l'installation, la configuration et le maintien à jour
Commercial sous licenceFacturation à la sonde, à l'hôte ou par palierSupport éditeur inclus, mise en route souvent plus rapide, coût récurrent à budgéter
SaaS (hébergé par l'éditeur)Abonnement mensuel, aucune infrastructure à maintenir en interneSimplicité de mise en œuvre, en contrepartie d'une dépendance à un prestataire externe et d'un flux de données de supervision qui transite par un tiers

Pour DKTOYS, dont l'équipe technique maîtrise déjà l'administration Linux et Windows à l'issue des cours précédents, une solution open source auto-hébergée sur le VLAN Supervision reste cohérente avec les compétences déjà en place, sans coût de licence récurrent à justifier pour un parc de taille encore modeste.

Ce qu'il faut retenir

La supervision transforme la détection d'incident, d'un mécanisme réactif dépendant du signalement utilisateur, en un mécanisme proactif fondé sur des sondes interrogeant régulièrement les équipements du parc DKTOYS, chacune évaluée selon des seuils qui produisent un état (OK, WARNING, CRITICAL, UNKNOWN). Le marché propose plusieurs familles d'outils, open source (Nagios, Centreon, Zabbix) ou commerciales (PRTG, solutions SaaS), qui partagent cette même logique. Le protocole le plus couramment utilisé pour interroger à distance les équipements réseau, objet du chapitre suivant, est SNMP.

Note de production : aucun support dédié à la supervision réseau n'a été localisé dans les supports du dépôt à la date de rédaction ; ce chapitre s'appuie sur le cadrage pédagogique du module et sur des connaissances générales du marché de la supervision.