Cette offre n'affiche pas de salaire. D'après 68 offres pour ce poste (Senior, Île-de-France), le marché se situe autour de 495€/j (425€/j–575€/j).
Dans le cadre d'un programme stratégique de transformation du système d'information, nous recherchons un Expert Monitoring & Observabilité afin de concevoir, déployer et faire évoluer la supervision d'applications critiques.
Vous interviendrez dès les phases de BUILD afin de garantir que les nouvelles applications disposent d'un niveau de supervision complet avant leur mise en production. Vous serez également un acteur clé de l'amélioration continue des outils de monitoring et d'observabilité, principalement basés sur Datadog et Splunk.
Vos missionsDéfinition de la stratégie de monitoringDéfinir les standards de supervision avant la mise en production des applications.
Identifier les composants critiques et les parcours utilisateurs à superviser.
Définir les métriques, logs, traces et événements nécessaires au suivi des services.
Contribuer à la stratégie globale d'observabilité.
Déployer et configurer les intégrations Datadog.
Mettre en place la collecte des métriques.
Concevoir des dashboards adaptés aux équipes techniques, applicatives et management.
Superviser les API, services, URL, certificats, traitements batch et files d'attente.
Mettre en œuvre les Service Maps.
Créer les monitors, alertes composites et mécanismes de détection d'anomalies.
Automatiser le déploiement des dashboards et configurations.
Définir les sources de logs à intégrer.
Configurer les flux de collecte et d'indexation.
Garantir la qualité et la cohérence des données collectées.
Concevoir des tableaux de bord techniques et opérationnels.
Développer les alertes de supervision.
Corréler les événements issus de différents composants.
Identifier rapidement les causes des incidents grâce à l'analyse des logs.
Définir les indicateurs techniques et métiers.
Construire des tableaux de bord de suivi des performances applicatives.
Mesurer notamment :
le nombre de transactions ;
les taux de succès et d'échec ;
les temps de réponse ;
les temps de traitement.
Développer une supervision orientée service et expérience utilisateur.
Définir des seuils d'alerte pertinents.
Réduire les faux positifs.
Classifier les alertes selon leur criticité.
Définir les circuits d'escalade.
Documenter chaque alerte (diagnostic, actions, responsables).
Participer à l'intégration avec ServiceNow pour l'automatisation des incidents.
Préparer la transition BUILD vers RUN.
Produire la documentation de supervision.
Former les équipes à l'utilisation de Datadog et Splunk.
Participer à l'amélioration continue des pratiques d'observabilité.
Datadog (APM, Dashboards, Monitors, Alerting)
Splunk
Architectures distribuées
IaaS
Conteneurs
API
Middleware
SQL
Analyse de performances
ServiceNow (atout)
ITIL
Un plan personnalisé pour postuler intelligemment à cette offre.
RIDCHA DATA couvre l’intégralité des métiers de l’informatique. RIDCHA DATA est spécialisée en infrastructure, architecture, chefferie de projets et Cloud - DevOps avec des compétences dans les domaines du transformation digital à forte valeur ajoutée. Nous nous positionnons sur le marché des applications stratégiques soutenues par les Nouvelles Technologies. Nous proposons des expertises métiers et technologiques en réponse aux attentes de nos clients en matière d’évolution de leurs systèmes d’information. Nous proposons les compétences d’ingénieurs informaticiens, capables d’assurer des missions dans la durée et d’offrir une capacité d’adaptation à des problématiques évoluées.
Voir toutes les offres de RIDCHA DATACliquez sur "Postuler" pour accéder à l'offre.