Cette offre n'affiche pas de salaire. D'après 13 offres pour ce poste (Senior, Paris), le marché se situe autour de 500€/j (500€/j–600€/j).
Le client est un distributeur international de matériel électrique, groupe de plusieurs milliards d'euros de CA annuel, historiquement organisé autour d'un réseau d'agences et de commerciaux. Depuis les années 2010, il exploite un Webshop B2B basé sur Hybris (SAP), fortement personnalisé sur toute la chaîne (infra, front, back, base de données, back-office, CMS). SAP arrêtant toute maintenance de Hybris (y compris sécurité) en juin 2026, le client doit migrer cette plateforme dans l'urgence.
En parallèle, un programme de fond vise à moderniser le cœur du système e-commerce vers une architecture composable, avec une migration vers le cloud Azure. Le client ne dispose pas en interne de toute l'expertise nécessaire pour mener ces transformations, d'où le recours à Theodo.
Le contexte est sensible : plusieurs prestataires externes interviennent en parallèle sur le programme, avec une coordination à assurer avec l'IT Groupe et les marques locales.
Le poste à pourvoir est un remplacement sur le rôle de SRE senior au sein de l'équipe Resilience, occupé jusqu'ici par un consultant Theodo qui avait lui-même succédé à un précédent titulaire du rôle parti en démission. Le client a exprimé le souhait de conserver une équipe infra Theodo en continu sur ce rôle.
Site Reliability Engineer (SRE) senior / Lead DevOps, en remplacement direct sur l'équipe Resilience (SRE / Platform Engineering) du client, dans le cadre d'un programme de modernisation e-commerce et de migration cloud Azure.
Responsabilités principales :
Piloter les stratégies de Haute Disponibilité (HA) et de Disaster Recovery (DR), garantir un retour rapide à un état nominal en cas d'incident.
Concevoir, automatiser et maintenir les plateformes Kubernetes sur Azure/AKS (Istio, Keda, réseau, load balancer, Front Door).
Gérer l'infrastructure via Terraform (Infrastructure as Code).
Maintenir et faire évoluer les chaînes CI/CD (GitHub Actions, Azure DevOps, ArgoCD, avec des briques historiques sur Bitbucket et Bamboo).
Mettre en œuvre des pratiques de Chaos Engineering pour tester la robustesse des systèmes et valider les scénarios de panne.
Définir les runbooks de restauration, coordonner la remédiation en cas d'incident, et instaurer une culture du REX / root cause analysis — point faible identifié côté client.
Porter une approche Zero Trust et Security by Design sur des environnements multiples.
Structurer et implémenter le modèle de Platform Engineering au sein de l'équipe Resilience, en soutien quotidien de l'équipe.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.