SRE Observabilité et Automatisation HF
Job Summary
Dans le cadre du renforcement de nos équipes techniques nous recherchons un SRE Observabilité afin de contribuer à la fiabilité la supervision et lautomatisation des opérations IT du groupe.
Intégré à léquipe Outils de Production vous participerez à la construction et à lévolution dune plateforme dobservabilité et dautomatisation utilisée à léchelle de lensemble du SI Boulanger et des filiales.
Léquipe développe et opère les solutions permettant :
la supervision des infrastructures et applications
lautomatisation des opérations RUN
lorchestration des remédiations automatiques
lamélioration continue de la fiabilité des plateformes
lindustrialisation des pratiques dexploitation
lintégration progressive de mécanismes dIA dans les opérations IT.
Notre objectif est de faire évoluer les opérations IT vers une approche moderne automatisée mesurable et orientée fiabilité en sappuyant fortement sur les principes SRE levent-driven automation et lobservabilité avancée.
Vos missions principales
Au sein dune équipe orientée plateforme et engineering vos responsabilités sarticulent autour des axes suivants :
Observabilité et supervision
Vous participez à la conception et à lévolution de la plateforme dobservabilité du groupe.
Vous intervenez notamment sur :
la collecte et la centralisation des métriques et logs
la création et loptimisation des dashboards
lamélioration des règles dalerting
lexploitation des données de monitoring et de logs pour fiabiliser les plateformes
la standardisation des pratiques dobservabilité.
Vous contribuerez également à faire évoluer lécosystème vers des pratiques dobservabilité modernes et industrialisées.
Automatisation et industrialisation
Vous participez au développement de mécanismes dautomatisation permettant de fiabiliser et simplifier les opérations IT.
Vous intervenez notamment sur :
lautomatisation des actions RUN et des tâches récurrentes
le développement de mécanismes de remédiation automatique
lindustrialisation des déploiements et opérations
lintégration dautomatisations event-driven
lamélioration continue des outils de production.
Une attention particulière est portée à la réduction des actions manuelles et à laugmentation de lefficacité opérationnelle des équipes IT.
Innovation et IA appliquée aux opérations
Léquipe travaille également sur lintégration progressive de mécanismes dautomatisation intelligente et dIA appliqués aux opérations IT.
Vous pourrez contribuer à :
lexploitation intelligente des événements et alertes
lamélioration de la qualification des incidents
lautomatisation avancée des remédiations
loptimisation des opérations grâce aux données dobservabilité.
Qualifications :
De formation supérieure en informatique vous disposez dune expérience en SRE dau moins 3 ans observabilité production engineering ou DevOps.
Nous recherchons avant tout un profil ayant une forte appétence pour :
la fiabilité des systèmes
lobservabilité moderne
lautomatisation
lamélioration continue
et les approches engineering appliquées aux opérations IT.
Compétences techniques attendues
Observabilité & monitoring :
bonne maîtrise de Prometheus / Thanos
expérience de Grafana et Alertmanager
maîtrise des environnements ELK / Kibana
utilisation avancée de PromQL et KQL
Automatisation & scripting :
bonne maîtrise de Python Bash et Java
expérience dAnsible
capacité à industrialiser et automatiser les opérations IT.
des APIs et intégrations
des architectures event-driven
des plateformes cloud et conteneurisées (Azure Docker Terraform)
de lautomatisation des opérations
Kubernetes & plateformes :
expérience significative sur Kubernetes :
déploiement
maintenance
scaling
supervision des clusters.
maîtrise des plateformes cloud et conteneurisées (Azure Docker Terraform)
Une expérience autour des approches event-driven de lautomatisation des remédiations ou des plateformes SRE modernes sera particulièrement appréciée.
Savoir-être :
Esprit danalyse et approche orientée résolution de problèmes
Capacité à investiguer des incidents complexes
Rigueur et sens de la fiabilité
Forte culture damélioration continue
Curiosité technique et volonté dindustrialiser les opérations
Capacité à collaborer avec des équipes transverses
Sens du service et de limpact métier des plateformes IT.
Mindset Pro simple et sympa.
Informations supplémentaires :
Pourquoi nous rejoindre
Des enjeux techniques à forte volumétrie et fort impact
Une équipe orientée engineering et plateforme
Une culture forte autour de lautomatisation et de la fiabilité
Des sujets innovants autour de lobservabilité moderne et de lIA appliquée aux opérations
Un rôle central dans la transformation des opérations IT dun groupe leader sur son marché et à dimension internationale.
Remote Work :
No
Employment Type :
Full-time
About Company
With over 70 years of experience and 25,000 products available in its 223 stores, on its website boulanger.com, and through its app, Boulanger is today the specialist in home equipment, including household appliances and multimedia. Our mission? To help everyone make the most of the ... View more