Cette offre n'affiche pas de salaire. D'après 75 offres pour ce poste (Senior, Île-de-France), le marché se situe autour de 500€/j (450€/j–575€/j).
Afin d’améliorer durablement la stabilité et la performance, une équipe dédiée de Site Reliability Engineering (SRE) – Flying Squad est créée.
Cette équipe transverse intervient en mode commando sur des périmètres critiques pour :
Éradiquer les causes profondes des incidents
Renforcer la résilience des systèmes
Apporter des pratiques SRE pérennes aux équipes internes
En tant que SRE, vous aurez pour mission de :
Restaurer et garantir la fiabilité des services critiques
Identifier et éliminer les causes racines des incidents
Améliorer la résilience, la performance et l’observabilité
Contribuer à une réduction d’au moins 20 % des incidents
Diffuser les bonnes pratiques SRE auprès des équipes internes
Analyser les incidents récurrents et le backlog de problèmes
Réaliser des post-mortems blameless
Identifier les causes profondes (techniques et organisationnelles)
Cartographier les dépendances (applications, batchs, flux de données)
Mettre en œuvre des corrections structurelles :
Optimisation des performances
Refactoring de code
Stabilisation des processus batch
Implémenter des mécanismes de résilience :
Retries, circuit breakers, timeouts
Participer au capacity planning
Déployer et optimiser les outils de monitoring (Dynatrace, Prometheus…)
Mettre en place des indicateurs SLI/SLO
Superviser les golden signals :
Latence
Trafic
Erreurs
Saturation
Réduire le bruit et améliorer la pertinence des alertes
Automatiser les tâches récurrentes (RUN)
Développer des scripts en :
Shell / Bash
PowerShell
Python
Implémenter des mécanismes de self-healing
Intervenir sur des environnements hybrides :
AWS / OCI
On-prem Linux / AIX
Contribuer à l’exploitation et à l’optimisation Kubernetes :
Troubleshooting
Capacity management
Observabilité
Gérer et sécuriser les certificats (rotation, expiration)
Contribuer au durcissement de l’infrastructure
Participer aux bonnes pratiques de sécurité applicative
Accompagner les équipes internes (DEV / OPS)
Documenter les patterns de fiabilité
Contribuer à la culture SRE ("You build it, you run it")
Un plan personnalisé pour postuler intelligemment à cette offre.
Adonys est une entreprise de services du numérique créée en 2014 par deux ingénieurs d'affaires, issus de SSII. Grâce à sa taille humaine, Adonys propose des solutions adaptées à tous pour un recrutement de prestataires efficients. Ainsi, nous intervenons de manière transverse sur les SI de nos clients. Chacun de nos collaborateurs a des objectifs personnels et professionnels et nous les conseillons afin qu'ils les atteignent. Au coeur de vos systèmes d'information, nous intervenons tant sur les parties techniques que sur les parties fonctionnelles ou managériales. Nos clients sont présents dans différents secteurs (banque, assurance, presse, mutuelle, éditeur de logiciel etc...)
Voir toutes les offres de AdonysCliquez sur "Postuler" pour accéder à l'offre.