Mission freelance – Bruxelles | Hybride 50% onsite minimum
Démarrage : 15/10/2026
Durée : jusqu’au 13/12/2028
Nous recherchons un Senior Monitoring & Observability Engineer pour renforcer une équipe IT en charge de la supervision et de l'observabilité d'un environnement informatique complexe.
Le rôle est particulièrement orienté Zabbix, avec une forte dimension monitoring, troubleshooting, automatisation, intégration d'outils et amélioration continue de l'observabilité.
Vous interviendrez sur l'ensemble de la chaîne de supervision : collecte des métriques, alerting, dashboards, monitoring des services métiers, gestion des incidents, automatisation et reporting.
Le poste convient à un profil très opérationnel et hands-on, capable d'administrer Zabbix tout en comprenant les environnements réseau, systèmes et applicatifs sous-jacents.
Administrer et faire évoluer Zabbix : dashboards, maps, items, triggers, templates et macros.
Concevoir et maintenir des templates de supervision réutilisables.
Mettre en place et optimiser la découverte automatique via LLD (Low-Level Discovery).
Travailler avec différents mécanismes de collecte : Zabbix Agent, SNMP, JMX, HTTP Agent, External Checks.
Optimiser les seuils et règles d'alerting afin de réduire les faux positifs et le bruit opérationnel.
Diagnostiquer les problèmes liés aux proxies, pollers, timeouts et à la collecte des données.
Administrer une architecture Zabbix distribuée et contribuer à son évolution.
Exploiter le module Zabbix Services / Business Service Monitoring.
Modéliser les services applicatifs et métiers à partir des composants techniques supervisés.
Construire des arbres de services et suivre les SLA/SLO et taux de disponibilité.
Corréler métriques, événements et alertes afin d'identifier plus rapidement les causes d'incidents.
Participer à la réduction du bruit de monitoring et à l'amélioration de la visibilité end-to-end.
Qualifier et traiter les incidents liés au monitoring dans ServiceNow.
Assurer le suivi des tickets jusqu'à leur résolution et clôture.
Contribuer à la fiabilité de la CMDB, notamment en lien avec les mécanismes de découverte.
Participer aux analyses de causes racines (RCA) sur des incidents complexes.
Vous serez amené à analyser des problématiques liées notamment à :
SNMP v2/v3, syslog, NetFlow, TCP/IP, routage, VLAN, ACL, firewall, VPN, SD-WAN.
Une bonne compréhension des environnements réseau est donc importante pour diagnostiquer les problèmes de collecte et de connectivité.
Développer des scripts Python et/ou Bash pour automatiser les contrôles, checks, traitements et reportings.
Concevoir des scripts de découverte personnalisés (LLD).
Consommer et intégrer des API REST : authentification, tokens, pagination, webhooks, etc.
Automatiser les échanges entre les différents outils de monitoring et ITSM.
Manipuler des données JSON/XML et contribuer aux flux d'intégration.
Superviser les sites web via Oh Dear ou une solution équivalente.
Suivre disponibilité, certificats SSL, performance et anomalies.
Exploiter les API de monitoring pour automatiser le reporting.
Produire des rapports de disponibilité, incidents, tendances et KPI/SLA.
Construire ou maintenir des dashboards de pilotage, notamment avec Power BI.
Utiliser Git pour le versioning des scripts et configurations.
Contribuer aux pratiques CI/CD appliquées au monitoring.
Participer à l'automatisation de l'infrastructure via Ansible / Terraform.
Intervenir ponctuellement sur des environnements Docker.
Maintenir la documentation technique et contribuer au transfert de connaissances.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.