Comment Northstar Systems a réduit ses temps de déploiement de 80 %
Une équipe de paiement a migré 40 services hors de VM configurées à la main en un week-end et déploie désormais en production plus d'une dizaine de fois par jour.
Résultats
Six mois après la migration
- Déploiements plus rapides
- %
- D'un cycle de mise en production de 45 minutes à 9 minutes, du push à la mise en ligne.
- Déploiements par jour
- Contre deux mises en production planifiées par semaine.
- Disponibilité de l'API
- %
- Sur l'API de paiement depuis le lancement.
- Migration
- jours
- 40 services migrés en un seul week-end.
Le défi
Northstar Systems traite les paiements par carte de marchands en ligne dans toute l’Europe. Sa plateforme comptait 40 services sur des machines virtuelles qu’une équipe ops de deux personnes configurait à la main.
Chaque mise en production partait le mardi ou le jeudi. Un déploiement occupait presque tout un après-midi, exigeait une fenêtre de maintenance pour les changements de base de données et bloquait les autres équipes pendant son exécution. Les ingénieurs regroupaient leurs changements pour limiter ce coût, si bien que chaque version portait plus de risques que la précédente.
La solution
L’équipe a décrit ses services, son réseau privé et ses variables d’environnement dans un seul fichier cloud.yaml, puis a relié le dépôt avec la CLI. Une copie de pré-production de la stack a tourné en parallèle pendant deux semaines pour comparer latence et taux d’erreur.
services:
- name: payments-api
type: web
healthCheckPath: /healthz
scaling: { minInstances: 3, maxInstances: 12 }
- name: ledger-worker
type: workerLe week-end de bascule, ils ont basculé le DNS service par service. Grâce aux déploiements sans coupure, l’API de paiement n’a perdu aucune requête, et le réseau privé a gardé la base du grand livre hors d’Internet.
Les résultats
Chaque fusion sur main part désormais en production. Des contrôles de santé valident chaque déploiement et un contrôle en échec déclenche un retour arrière automatique : les ingénieurs ont cessé de regrouper leur travail. L’équipe ops s’occupe maintenant des outils antifraude au lieu de corriger des serveurs.
“Nous avons migré toute notre plateforme en un week-end. Les déploiements qui prenaient un après-midi se terminent avant le café, et notre petite équipe livre enfin tous les jours.”