Cybersécurité24 juillet 2026· via BleepingComputer

Panne de Microsoft 365 liée à une erreur de maintenance automatisée

Panne de Microsoft 365 liée à une erreur de maintenance automatisée

Image : BleepingComputer

Une requête de maintenance automatisée, initialement routinière chez Microsoft, s’est transformée jeudi en une panne continentale de services, privant des millions d’utilisateurs de Microsoft 365 et Azure d’accès pendant plusieurs heures. L’entreprise a confirmé que l’incident provenait d’un bug dans son système de maintenance réseau, qui a supprimé par erreur des routes IP sur plus d’appareils que prévu, perturbant les services cloud centraux.

Déroulement de l’erreur de routage

L’outil de maintenance réseau automatisé de Microsoft est conçu pour simplifier les mises à jour en déployant des modifications de routage à travers son infrastructure mondiale de centres de données. Cependant, jeudi, le système a mal fonctionné : il a retiré des routes IP valides sur un nombre bien plus élevé d’appareils que nécessaire. Sans ces routes, le trafic destiné à Microsoft 365 et Azure ne pouvait plus atteindre sa destination, provoquant des temps d’attente généralisés et une dégradation des services. L’entreprise a indiqué que le problème avait été maîtrisé en quelques heures, mais ses répercussions ont persisté jusqu’en soirée pour certains utilisateurs.

Conséquences pour les utilisateurs et les charges de travail

La panne a touché les entreprises utilisant Exchange Online, SharePoint Online et Teams, ainsi que les clients dépendant des services de calcul et de stockage d’Azure. Des signalements d’échecs de connexion, d’e-mails retardés et de machines virtuelles bloquées ont circulé sur les réseaux sociaux et les outils de surveillance des entreprises. Bien que Microsoft ait rétabli les services en annulant les modifications de routage involontaires, cet épisode rappelle qu’une seule étape d’automatisation mal configurée peut déclencher un incident majeur pour les plateformes à grande échelle.

Pourquoi cet incident est significatif

L’automatisation vise à réduire les erreurs humaines, mais lorsqu’un script de maintenance échoue, l’impact peut être dévastateur. Cette panne montre que même les fournisseurs cloud les plus avancés doivent combiner leurs outils automatisés avec des mesures de sécurité strictes, comme des déploiements canaris, des disjoncteurs et des mécanismes de retour arrière instantanés, pour éviter qu’une mauvaise modification ne paralyse les services de millions d’utilisateurs. Pour les entreprises, la leçon est claire : valider chaque modification automatisée comme s’il s’agissait d’une intervention manuelle, et s’assurer que leurs procédures de reprise après sinistre intègrent ce type d’échecs systémiques.


Source : BleepingComputer. Synthèse éditoriale assistée par IA — TechnoExpress.

Lire la source originale sur BleepingComputer →

← Retour à l'accueil