Τι πρέπει να γνωρίζουμε
Η διακοπή του AWS us-east-1 στις 20 Οκτωβρίου 2025 επηρέασε μεγάλο αριθμό υπηρεσιών που εξαρτώνταν άμεσα ή έμμεσα από την περιοχή. Το περιστατικό υπενθύμισε ότι η μεγάλη κλίμακα δεν εξαλείφει τον κίνδυνο κοινών εξαρτήσεων.
Οι υπηρεσίες cloud και τα παγκόσμια δίκτυα είναι κατανεμημένα, αλλά εξακολουθούν να έχουν κοινές εξαρτήσεις. Ένα control plane, μια βάση δεδομένων ρυθμίσεων, ένα region ή μια διασύνδεση μεταξύ δύο δικτύων μπορεί να επηρεάσει πολλές υπηρεσίες ταυτόχρονα.
Γιατί έχει σημασία στην πράξη
Η μεγάλη κλίμακα δεν εξαφανίζει τις αστοχίες· αλλάζει τον τρόπο με τον οποίο διαδίδονται. Για αυτό είναι σημαντικό να ξεχωρίζουμε αν ένα συμβάν αφορά traffic serving, management APIs, συγκεκριμένη περιοχή ή κάποιο upstream dependency πριν θεωρήσουμε ότι ολόκληρη η πλατφόρμα έχει τεθεί εκτός λειτουργίας.
Πώς το αξιολογούμε σωστά
Η επιχειρησιακή ανθεκτικότητα χρειάζεται dependency mapping, παρακολούθηση από περισσότερα από ένα σημεία και σχέδιο για degraded operation. Η χρήση ενός μεγάλου παρόχου μειώνει ορισμένους κινδύνους, αλλά δεν καταργεί την ανάγκη για αρχιτεκτονική ανάκαμψης.
Τι πρέπει να κάνει ένας διαχειριστής
Η πρακτική αξία βρίσκεται στη συνεχή παρακολούθηση, στην τεκμηρίωση των αλλαγών και στη δυνατότητα ασφαλούς rollback. Όταν γνωρίζουμε τις εξαρτήσεις μιας υπηρεσίας και έχουμε δοκιμάσει τη διαδικασία ανάκτησης, ένα μεμονωμένο πρόβλημα είναι πολύ λιγότερο πιθανό να εξελιχθεί σε παρατεταμένη διακοπή.