- Microsoft a explicat că o eroare de mentenanță a dus la căderea masivă a serviciilor M365 și Azure, afectând utilizatorii din America de Nord.
Pe 23 iulie, o întrerupere majoră a afectat serviciile Microsoft 365, inclusiv Teams, SharePoint și Azure. Utilizatorii din America de Nord au fost cei mai grav afectați, dar impactul s-a resimțit în întreaga lume. Un incident care a durat câteva ore și a întrerupt fluxurile de lucru în companii și instituții. Microsoft a identificat cauza: o eroare într-un sistem automat de mentenanță a rețelei.
Cauza întreruperii: o eroare în sistemul automat de mentenanță
Conform unei postări pe blogul oficial, Microsoft explică faptul că întreruperea a fost cauzată de o eroare în sistemul automatizat de gestionare a cererilor de mentenanță a rețelei. Acest sistem, care rulează permanent pentru a optimiza traficul, a aplicat în mod greșit un set de modificări, eliminând rute IP de pe mai multe dispozitive decât era intenționat. Ca urmare, traficul către Microsoft 365 nu a mai putut fi rutat corect, serviciile devenind inaccesibile.
Impactul: Teams, SharePoint și Azure au căzut
Serviciile afectate includ Microsoft Teams, SharePoint Online, OneDrive for Business, Azure Active Directory și alte componente ale ecosistemului M365. Utilizatorii au raportat imposibilitatea de a se conecta la Teams, întârzieri la încărcarea documentelor în SharePoint și erori de autentificare. Deși Microsoft a precizat că întreruperea s-a concentrat în America de Nord, unele organizații din Europa și Asia au semnalat, de asemenea, probleme minore. Compania a lucrat la remedierea defecțiunii și a confirmat că serviciile au fost complet restaurate spre seara zilei de 23 iulie.
Context: fiabilitatea serviciilor cloud
Acest incident reamintește că niciun serviciu cloud nu este perfect imun la întreruperi. Chiar și Microsoft, cu o infrastructură uriașă, poate fi afectat de erori umane sau de automatizare. Potrivit raportului, bug-ul a apărut în software-ul propriu de management al rețelei, nu din cauza unui atac extern. Microsoft investighează în continuare pentru a îmbunătăți sistemele de prevenție.
Ce înseamnă pentru tine
- Nu te baza exclusiv pe un singur serviciu cloud: Dacă folosești intens Microsoft 365, planifică alternative pentru situații critice – de exemplu, o soluție de backup pentru documente sau un canal de comunicare de rezervă (Slack, Google Meet).
- Monitorizează starea serviciilor: Abonează-te la paginile oficiale de status (Microsoft 365 Service Health Status) pentru a primi notificări rapide în caz de întrerupere.
- Documentează incidentele: Dacă ești responsabil IT, înregistrează durata și impactul căderilor pentru a evalua riscurile și a ajusta planurile de continuitate.