Temps d’arrêt
Le temps d’arrêt est une période pendant laquelle un système n’est pas disponible. Il peut s’appliquer à n’importe quel ordinateur ou réseau, mais ce terme est le plus souvent utilisé en référence aux serveurs. En particulier, la fiabilité d’un serveur Web est souvent mesurée en fonction du temps d’arrêt, l’idéal étant un temps d’arrêt nul ou très court.
Il existe plusieurs raisons pour lesquelles un serveur peut subir un temps d’arrêt :
- Redémarrage du serveur - Le redémarrage d’un serveur peut nécessiter quelques minutes de temps d’arrêt, car le système doit s’arrêter, redémarrer, puis relancer les processus nécessaires pour répondre aux requêtes entrantes.
- Redémarrage d’un logiciel - Le redémarrage d’un processus, comme Apache sur un serveur Web, peut entraîner quelques secondes de temps d’arrêt pendant le redémarrage du processus.
- Déconnexion du réseau - Si un serveur est physiquement déconnecté d’un réseau, les systèmes de ce réseau ne pourront plus y accéder.
- Panne du réseau - Si une partie du réseau, y compris Internet, ne fonctionne pas entre le serveur et le client, le client ne pourra pas communiquer avec le serveur.
- Surcharge du trafic - Si un serveur reçoit plus de trafic qu’il ne peut en gérer, il ne pourra pas répondre à toutes les requêtes. Les utilisateurs peuvent subir un temps d’arrêt jusqu’à ce que le trafic diminue. Cela peut être dû à une hausse soudaine du trafic ou à une attaque DDoS.
- Panne matérielle - Si un composant matériel important, comme un HDD ou un SSD, tombe en panne, le serveur peut cesser de fonctionner.
- Panne logicielle - Si un processus sur un serveur, comme le service httpd (HTTP), cesse de fonctionner, le serveur ne répondra plus aux requêtes jusqu’au redémarrage du processus.
- Panne de courant - Si l’alimentation électrique est interrompue et qu’aucune alimentation de secours n’est disponible, par exemple un générateur ou un UPS, les systèmes concernés seront hors ligne jusqu’au rétablissement du courant.
- Attaque d’un pirate informatique - Si un pirate informatique prend le contrôle d’un serveur, il peut empêcher l’accès aux services requis, ce qui oblige le serveur à cesser de répondre.
Pour réduire le temps d’arrêt, les administrateurs de serveurs doivent mettre en place des mesures de sécurité solides et de la redondance. La sécurité du réseau aide à protéger contre les activités malveillantes, comme les connexions non autorisées et les attaques DDoS. La redondance, notamment les systèmes de stockage RAID et les générateurs d’alimentation de secours, aide à éviter les temps d’arrêt dus aux pannes matérielles. Dans certains cas, plusieurs serveurs peuvent être configurés afin qu’un serveur secondaire prenne le relais si le serveur principal tombe en panne.
Même si les administrateurs de serveurs essaient de réduire le temps d’arrêt autant que possible, celui-ci est parfois inévitable. Par exemple, lors de la migration d’un serveur, plusieurs minutes, voire quelques heures, de temps d’arrêt peuvent être nécessaires. Ce type de « temps d’arrêt planifié » est généralement programmé tôt le matin ou pendant le week-end, lorsque le niveau de trafic est le plus faible.
Testez vos connaissances