Basé sur 53 offres pour ce poste (Mid, France, 3 dernières semaines). Fourchette habituelle 350€/j–500€/j, médiane 450€/j. Cette offre (450€/j) est dans la fourchette.
Notre client, acteur majeur de la protection sociale complémentaire, renforce le pôle Observabilité et Fiabilité de sa Direction Relation Client et Production. Ce pôle garantit la disponibilité, la performance, la résilience et l'observabilité d'un SI de 8 000 serveurs et 160 applications Java, réparties sur deux salles informatiques et un site de secours. La mission s'inscrit dans un dispositif de production 24/7 avec astreinte.
Missions
Assurer le maintien en conditions opérationnelles des services, infrastructures et plateformes selon les objectifs de disponibilité et de qualité de service
Surveiller et analyser les événements, alertes et incidents de production : diagnostic, traitement et coordination avec les équipes concernées
Réaliser les analyses post-incidents, identifier les causes racines et piloter les plans d'actions de fiabilisation
Anticiper les incidents par l'analyse des tendances, des capacités, des signaux faibles et des risques identifiés sur les plateformes
Maintenir et faire évoluer les tableaux de bord, indicateurs et alertes d'observabilité (Prometheus, Grafana, Centreon, Splunk, Tempo)
Réduire le bruit opérationnel : optimisation des règles d'alerting et réduction du volume d'alertes non pertinentes
Participer aux cellules d'incident, de crise et aux démarches d'amélioration continue de la production
Contribuer à l'automatisation, l'industrialisation et la simplification des activités d'exploitation
Maintenir et enrichir la documentation, les procédures et les référentiels de l'activité
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.