Service Reliability Engineer (SRE)
Skills
About the role
Au sein d?une Direction IT et du département Production, le consultant intégrera une équipe transverse en charge de la fiabilité et de l?excellence opérationnelle des plateformes de production critiques.
La mission s?inscrit dans une démarche de transformation des pratiques d?exploitation avec pour objectif de renforcer la disponibilité, la résilience, la performance et la sécurité des services, tout en améliorant leur exploitabilité et en réduisant les risques opérationnels.
Positionné à l?interface entre les équipes Production, Développement, DevOps et Sécurité, le SRE intervient sur l?ensemble du cycle de vie des applications. Il accompagne les équipes dans l?anticipation des impacts des changements, la gestion et la prévention des incidents ainsi que dans la mise en ?uvre des bonnes pratiques de production.
Une part importante de la mission concerne également le pilotage des niveaux de service (SLO), la mise en place de dispositifs de supervision, d?alerting et de tableaux de bord, ainsi que l?analyse des métriques permettant d?identifier les risques et les axes d?amélioration.
Le consultant contribuera à l?automatisation des activités de production, à la maîtrise de l?obsolescence et des risques IT/Cybersécurité ainsi qu?aux démarches d?amélioration continue. Il participera également aux analyses post-incidents, aux RETEX et à la diffusion des bonnes pratiques au sein de la communauté Production/SRE.
L?environnement est international et transverse, avec de nombreux interlocuteurs techniques et métiers et une utilisation régulière de l?anglais.
Profil candidat:
Indispensables : SRE, Production IT, DevOps, ITIL, ServiceNow, gestion des incidents/problèmes/changements, monitoring & alerting, SLO, résilience, automatisation, infrastructures, risques IT / cybersécurité, anglais.
Questions about this role
Want AI Applyd to auto-apply to roles like this?
We tailor your resume per posting, fill the forms, and track replies for you.