SRE Observabilité et Automatisation HF

BOULANGER


Job Location:

Lesquin - France

Monthly Salary: Not Disclosed
Posted on: 30+ days ago
Vacancies: 1 Vacancy

Job Summary

Dans le cadre du renforcement de nos équipes techniques nous recherchons un SRE Observabilité afin de contribuer à la fiabilité la supervision et lautomatisation des opérations IT du groupe.

Intégré à léquipe Outils de Production vous participerez à la construction et à lévolution dune plateforme dobservabilité et dautomatisation utilisée à léchelle de lensemble du SI Boulanger et des filiales.

Léquipe développe et opère les solutions permettant :

  • la supervision des infrastructures et applications

  • lautomatisation des opérations RUN

  • lorchestration des remédiations automatiques

  • lamélioration continue de la fiabilité des plateformes

  • lindustrialisation des pratiques dexploitation

  • lintégration progressive de mécanismes dIA dans les opérations IT.

Notre objectif est de faire évoluer les opérations IT vers une approche moderne automatisée mesurable et orientée fiabilité en sappuyant fortement sur les principes SRE levent-driven automation et lobservabilité avancée.

Vos missions principales

Au sein dune équipe orientée plateforme et engineering vos responsabilités sarticulent autour des axes suivants :

Observabilité et supervision

Vous participez à la conception et à lévolution de la plateforme dobservabilité du groupe.

Vous intervenez notamment sur :

  • la collecte et la centralisation des métriques et logs

  • la création et loptimisation des dashboards

  • lamélioration des règles dalerting

  • lexploitation des données de monitoring et de logs pour fiabiliser les plateformes

  • la standardisation des pratiques dobservabilité.

Vous contribuerez également à faire évoluer lécosystème vers des pratiques dobservabilité modernes et industrialisées.

Automatisation et industrialisation

Vous participez au développement de mécanismes dautomatisation permettant de fiabiliser et simplifier les opérations IT.

Vous intervenez notamment sur :

  • lautomatisation des actions RUN et des tâches récurrentes

  • le développement de mécanismes de remédiation automatique

  • lindustrialisation des déploiements et opérations

  • lintégration dautomatisations event-driven

  • lamélioration continue des outils de production.

Une attention particulière est portée à la réduction des actions manuelles et à laugmentation de lefficacité opérationnelle des équipes IT.

Innovation et IA appliquée aux opérations

Léquipe travaille également sur lintégration progressive de mécanismes dautomatisation intelligente et dIA appliqués aux opérations IT.

Vous pourrez contribuer à :

  • lexploitation intelligente des événements et alertes

  • lamélioration de la qualification des incidents

  • lautomatisation avancée des remédiations

  • loptimisation des opérations grâce aux données dobservabilité.


Qualifications :

De formation supérieure en informatique vous disposez dune expérience en SRE dau moins 3 ans observabilité production engineering ou DevOps.

Nous recherchons avant tout un profil ayant une forte appétence pour :

  • la fiabilité des systèmes

  • lobservabilité moderne

  • lautomatisation

  • lamélioration continue

  • et les approches engineering appliquées aux opérations IT.

Compétences techniques attendues

Observabilité & monitoring :

  • bonne maîtrise de Prometheus / Thanos

  • expérience de Grafana et Alertmanager

  • maîtrise des environnements ELK / Kibana

  • utilisation avancée de PromQL et KQL

Automatisation & scripting :

  • bonne maîtrise de Python Bash et Java

  • expérience dAnsible

  • capacité à industrialiser et automatiser les opérations IT.

  • des APIs et intégrations

  • des architectures event-driven

  • des plateformes cloud et conteneurisées (Azure Docker Terraform)

  • de lautomatisation des opérations

Kubernetes & plateformes :

  • expérience significative sur Kubernetes :

    • déploiement

    • maintenance

    • scaling

    • supervision des clusters.

  • maîtrise des plateformes cloud et conteneurisées (Azure Docker Terraform)

Une expérience autour des approches event-driven de lautomatisation des remédiations ou des plateformes SRE modernes sera particulièrement appréciée.

Savoir-être :

  • Esprit danalyse et approche orientée résolution de problèmes

  • Capacité à investiguer des incidents complexes

  • Rigueur et sens de la fiabilité

  • Forte culture damélioration continue

  • Curiosité technique et volonté dindustrialiser les opérations

  • Capacité à collaborer avec des équipes transverses

  • Sens du service et de limpact métier des plateformes IT.

  • Mindset Pro simple et sympa.


Informations supplémentaires :

Pourquoi nous rejoindre

  • Des enjeux techniques à forte volumétrie et fort impact

  • Une équipe orientée engineering et plateforme

  • Une culture forte autour de lautomatisation et de la fiabilité

  • Des sujets innovants autour de lobservabilité moderne et de lIA appliquée aux opérations

  • Un rôle central dans la transformation des opérations IT dun groupe leader sur son marché et à dimension internationale.


Remote Work :

No


Employment Type :

Full-time

Dans le cadre du renforcement de nos équipes techniques nous recherchons un SRE Observabilité afin de contribuer à la fiabilité la supervision et lautomatisation des opérations IT du groupe.Intégré à léquipe Outils de Production vous participerez à la construction et à lévolution dune plateforme dob...

About Company

Company Logo

With over 70 years of experience and 25,000 products available in its 223 stores, on its website boulanger.com, and through its app, Boulanger is today the specialist in home equipment, including household appliances and multimedia. Our mission? To help everyone make the most of the ... View more

View Profile View Profile