Votre rôle au sein d'Exaion :
Rattaché(e) au département Infrastructure, vous êtes responsable du bon fonctionnement global des infrastructures et de leur évolution continue. Votre rôle centralise deux volets essentiels : assurer la stabilité opérationnelle (support, maintenance corrective et préventive) et participer à la conception ou au déploiement de nouvelles solutions adaptées aux besoins métiers.
Vous agissez comme un pivot technique, collaborant avec toutes les équipes internes tout en garantissant une communication transparente lors des incidents ou des évolutions majeures.
Vos missions sont les suivantes :
- Maintenance Opérationnelle & Gestion des Incidents
- Supervision proactive : Vous effectuez la surveillance quotidienne des systèmes et infrastructures. Vous optimisez continuellement les outils d’alerting pour garantir une visibilité maximale sur la santé des environnements.
- Traitement des tickets : Vous intervenez sur la résolution des incidents remontés par les alertes ou les autres équipes techniques. Vous prenez en charge les dossiers nécessitant une expertise pointue.
- Intervention rapide : En cas d’incident critique, vous réagissez sous contraintes de délais pour analyser le problème, diagnostiquer la cause racine et mettre en place une solution corrective immédiate.
- Maintenance courante : Vous gérez les évolutions régulières et planifiez/mettez en œuvre les maintenances correctives et évolutives, en cohérence avec la roadmap technologique de l’entreprise.
- Conception, Évolution & Documentations
- Évolution technique : Dans le strict respect du cadre technique défini, vous proposez des correctifs et des améliorations (architecture).
- Implémentation de nouvelles solutions : Vous concevez et déployez des évolutions techniques pour répondre aux problématiques spécifiques des métiers. Selon vos missions, vous participez également à la conception et au déploiement de nouvelles infrastructures sur de nouveaux sites.
- Capitalisation knowledge : Vous avez à cœur de maintenir une documentation technique et des procédures opérationnelles exhaustives, exactes et constamment mises à jour.
- Gestion des Problèmes Amélioration Continue
- Approche préventive : Vous mettez en place une démarche structurée pour identifier les causes des incidents récurrents afin de les prévenir durablement.
- Résolution transversale : Selon votre niveau d'expertise et l'impact des problèmes, vous proposez des actions correctives aux équipes concernées ou pilotez des projets transverses dédiés à la fiabilisation globale.
- Collaboration, Coordination & Communication
- Travail d’équipe : Vous collaborez en permanence avec les autres ingénieurs et équipes techniques pour affiner vos analyses, harmoniser vos choix et coordonner vos interventions.
- Aide à la décision (Arbitrage) : Lorsque des arbitrages techniques ou des priorisations sont nécessaires (sollicitation de l’équipe, du RSSI, de la Direction Technique ou du COMEX), vous préparez les éléments factuels et comparatifs permettant la prise de décision éclairée.
- Communication des impacts :
- En cas d’incident ou de changement impactant les utilisateurs (internes, clients, métiers) : Vous vous assurez qu’une information claire, précise et opportune est diffusée. Vous pouvez être l’interlocuteur direct pour cette communication interne ou externe selon la criticité.
- Animation des processus : Vous participez activement aux réunions de suivi d’activités et aux ateliers techniques. Vous proposez des ajustements pour améliorer l’efficacité des échanges (fréquence, contenu, création d’ateliers ad’hoc).
Environnements techniques
- OS / Virtualisation : Debian, Ubuntu, CentOS, OpenStack, Proxmox, Kubernetes
- Outillage : Sensu, ELK, Prometheus, Grafana, Netbox, Ansible
- Réseau : Cisco, Mellanox, SDN (OpenVSwitch)
- Programmation : Bash, Python, C