Ingénierie
Ingénieur fiabilité (SRE)
Gardez la plateforme rapide et disponible dans toutes les régions, et rendez les incidents ennuyeux.
- Télétravail · Amériques
- Temps plein
À propos du poste
Vous rejoindrez l’équipe infrastructure qui fait tourner la flotte sous chaque service client. Vous automatiserez ce que nous faisons encore à la main et transformerez chaque incident en correctif durable.
Responsabilités
- Exploiter et améliorer la flotte dans toutes les régions, de la planification de capacité aux mises à jour du noyau
- Construire des outils pour des déploiements sûrs, la bascule et la reprise après sinistre
- Piloter la réponse aux incidents et rédiger des analyses sans reproche qui mènent à de vrais changements
- Définir des objectifs de niveau de service avec les équipes produit et alerter sur ce qui compte
Profil recherché
- Au moins quatre ans dans un rôle SRE, plateforme ou infrastructure
- Une connaissance approfondie de Linux et du réseau, de TCP au DNS
- Une expérience de l’infrastructure as code et d’un langage de script
- Du calme sous pression, avec des points écrits clairs pendant les incidents
Un plus
- Une expérience de réseaux multirégions ou en périphérie
- Une connaissance d’eBPF ou des outils de performance bas niveau
Avantages
Tout ce qui figure sur la page carrières : actions, couverture santé, trente jours de congés payés, budget formation et deux séminaires d’équipe par an.
Processus de recrutement
Un appel de présentation de 30 minutes, un exercice à la maison ou une revue de portfolio à faire à votre rythme, deux entretiens avec l’équipe et un dernier échange avec un fondateur. La plupart des processus durent trois semaines.