Votre rôle au sein d'Exaion :
Rattaché(e) à l'équipe infrastructure, votre mission est de résoudre les problèmes complexes qui bloquent la progression technique, d'optimiser les coûts et la performance des clusters existants, et de définir les standards techniques pour les futurs projets.
Vos missions sont les suivantes :
- Expertise Technique & Résolution d’Incidents Complexes
- Support Niveau Expert (Niveau 4/5) : Vous prenez en charge les incidents majeurs, cryptiques ou systémiques que les équipes opérationnelles n’arrivent pas à diagnostiquer ou résoudre seuls.
- Investigation technique : Vous diagnostiquez les problèmes complexes au niveau du système Linux, des containers et des réseaux pour identifier leurs causes racines.
- Stabilisation Opérationnelle : Vous mettez en place des correctifs définitifs aux incidents récurrents pour empêcher leur répétition, sécurisant ainsi la stabilité des services produits par l’infrastructure.
- Optimisation des Performances & Coûts (FinOps Technique)
- Optimisation des ressources : Vous analysez l’utilisation du CPU, de la mémoire, du stockage et du réseau sur les clusters, et proposez des ajustements concrets pour améliorer leur efficacité.
- Optimisation des Coûts : En lien avec le Responsable Infrastructure, vous identifiez les leviers techniques de réduction des coûts cloud (right-sizing, optimisation des instances spot, gestion du stockage).
- Performance des Workloads : Vous validez que les applications déployées respectent les bonnes pratiques de consommation de ressources pour éviter les saturations injustifiées.
- Accompagnement Technologique & Montée en Compétence
- Mentorat : Vous guidez les membres de l’équipe sur les aspects techniques avancés de Kubernetes, favorisant ainsi la diffusion du savoir interne.
- Support aux Projets Techniques : Lors de la mise en place de nouvelles fonctionnalités ou architectures proposées par le Responsable Infrastructure, vous apportez votre expertise pour valider la faisabilité technique et la robustesse des choix.
- Capitalisation du Savoir : Vous rédigez et maintenez la documentation technique critique (runbooks de résolution d’incidents, guides de configuration standardisée) pour rendre l’équipe autonome face aux situations connues.
- Veille Technique & Expérimentation Ciblée
- Proof of Concept (PoC) : Lorsque l’équipe Infrastructure identifie un besoin d’évolution technologique, vous réalisez les tests techniques et les PoC nécessaires pour évaluer la pertinence d’un nouvel outil ou d’une nouvelle méthode avant qu’elle ne soit adoptée.
- Veille CNCF Ciblée : Vous restez informé des évolutions de Kubernetes et des outils associés pour alerter le Responsable Infrastructure des opportunités d’amélioration ou des risques de sécurité émergents.
- Sécurisation Opérationnelle
- Application des Politiques de Sécurité : Vous accompagnez le Responsable Infrastructure dans l’application concrète des politiques de sécurité définies (durcissement des nodes, gestion des secrets, network policies) sur les clusters en production.
- Conformité Technique : Vous vous assurez que les configurations des clusters respectent les standards de conformité (ISO 27001, NIS2) d’un point de vue purement technique.