CONTEXTE & OBJECTIF DU POSTE
Le client est un groupe multi-pays (France, Espagne, Allemagne) qui recrute un référent technique DevOps Groupe, positionné comme Principal/Staff Engineer. Il définit la vision technique DevOps, anime la communauté d'ingénieurs et garantit la qualité, la sécurité et la fiabilité des systèmes en production sur toutes les filiales.
Trois enjeux :
- Définir et faire adopter la roadmap technique DevOps groupe (CI/CD, conteneurisation, observabilité, IaC)différentes
- Animer la guilde DevOps groupe, piloter les métriques DORA et intégrer les pratiques DevSecOps dans les pipelines
- Être le point d'escalade technique sur les problèmes les plus difficiles et garantir la fiabilité des services en production (SRE)
MISSIONS PRINCIPALES
Vision & Roadmap Technique DevOps
- Définir et maintenir la roadmap des outils DevOps groupe : CI/CD, conteneurisation, observabilité, IaC
- Identifier les innovations technologiques pertinentes et arbitrer les choix d'outils pour l'ensemble des filiales
- Harmoniser les pratiques et les standards entre les équipes France, Espagne et Allemagne
Animation de la Communauté DevOps
- Animer la guilde DevOps : ateliers, démos techniques, sessions de partage de bonnes pratiques, retours d'expérience
- Réduire les silos entre équipes et diffuser les patterns communs
- Créer et maintenir l'adhésion des équipes sans autorité hiérarchique
Expertise & Mentorat
- Être le point d'escalade technique pour les problèmes les plus complexes des équipes filiales
- Accompagner et faire monter en compétences les ingénieurs DevOps du groupe
- Conseil sur les choix d'architecture complexes aux tech leads et architectes
Qualité, Sécurité & DevSecOps
- Mettre en place et piloter les métriques DORA (Deployment Frequency, Lead Time, MTTR, Change Failure Rate)
- Intégrer les pratiques DevSecOps dans les pipelines CI/CD (SAST, DAST, SCA, gestion des secrets)
- Collaborer avec le RSSI sur la sécurité du delivery
Fiabilité & Performance en Production (SRE)
- Garantir la disponibilité, la résilience et la performance des services - SLI/SLO/error budgets
- Mettre en place ou améliorer les stacks d'observabilité (Prometheus, Grafana, ELK)
- Piloter les incidents complexes, les post-mortems et les plans d'amélioration continue