High Availability
Filed under
3 posts
Le correctif partage le sort de la panne
Lambda 2023, l'incident DNS DynamoDB, la panne du plan de contrôle Azure : pourquoi la reprise meurt avec l'incident, plus un lab de stabilité statique.
Deux zones, dix-huit heures, une seule cause
Des drones ont plongé la région me-central-1 d'AWS dans des mois de reprise, et son conseil de DR : restaurer en Europe. Plus un lab reliant noms et ID d'AZ.
L'isolation des AZ a tenu. Votre architecture, non.
Une panne de refroidissement a tué des racks d'une zone us-east-1 et un quorum est mort avec eux. Ce que couvre le blast radius, plus un détecteur read-only.