Comment VectorGrid a absorbé un pic de lancement de 50× sans une seule alerte
Une plateforme d'analytics est passée d'une charge stable à cinquante fois son trafic habituel le jour du lancement, puis est redescendue, sans aucune intervention manuelle.
Résultats
Le jour du lancement, en chiffres
- Pic de trafic
- ×
- Par rapport à la moyenne hebdomadaire, en deux heures.
- Alertes
- 0
- Aucune astreinte déclenchée pendant le lancement.
- Coût de calcul en baisse
- %
- En réduisant la capacité la nuit au lieu de tourner au maximum.
- Latence p95
- ms
- Stable pendant tout le pic.
Le défi
Les tableaux de bord de VectorGrid sont utilisés par des milliers d’équipes, et un lancement public promettait un pic important mais impossible à chiffrer. L’ancienne infrastructure avait une taille fixe : l’équipe payait la capacité de pointe tout le mois ou risquait de tomber le jour où cela comptait le plus.
La solution
Ils ont défini des règles de mise à l’échelle sur le CPU et la latence des requêtes pour chaque service web, avec un nombre minimal d’instances pour le trafic du matin et un plafond pour limiter les dépenses. Les workers de requêtes sont passés derrière le réseau privé pour monter en charge selon la profondeur de la file, sans exposer de point d’accès.
Avant le lancement, l’équipe a rejoué le trafic de production à 60 fois son niveau habituel sur une copie de pré-production pour vérifier que les limites tenaient.
Les résultats
Le jour du lancement, le trafic a atteint 50 fois la moyenne en deux heures. Les nouvelles instances ont démarré en quelques secondes, la latence est restée stable et personne n’a été alerté. Le lendemain matin, les services étaient redescendus d’eux-mêmes, et la facture de calcul du mois est passée sous celle de l’ancienne infrastructure fixe.
“L'autoscaling nous a portés pendant un lancement qui a multiplié notre trafic par cinquante. Personne n'a été alerté, et la facture est restée prévisible.”