Contexte
L'Ingénieur OPS intervient au sein d'une équipe mode Agile (Scrum), autonome et pluridisciplinaire, composée de ressources IT métiers (les « Dev ») et de ressources OPS, responsabilisées autour d’un ou plusieurs produits.
Expérience dans l'environnement de la prestation : 3-5 ans inclus.
Missions
- Participer à l’ensemble des rituels Agile (Sprint planning, Daily Meeting, Review, Rétro).
- Communiquer des exigences infrastructure et exploitation dans le product backlog.
- Participer à l’évaluation de la complexité des User Stories lors des sprint planning.
- Implémenter les User Stories techniques et d’exploitation du Product Backlog.
- Réaliser durant le sprint de façon autonome les tâches relatives à la production, ou bien coordonner les parties prenantes « Production Mutualisée » extérieures à l'équipe Agile.
- Déclarer les obstacles (impediments) et les remonter aux bons interlocuteurs.
- Assurer la montée en compétence de l’équipe Agile sur les bonnes pratiques DevOps (Profil confirmé et Senior).
- Sensibiliser et propager les bonnes pratiques OPS au sein de l’équipe.
- Faire monter en compétence les membres de son équipe sur les outils d’exploitation mis à disposition dans le cadre DevOps.
- Promouvoir les solutions standards ou expérimentales répondant aux problématiques de l’équipe ou orienter vers les architectes.
- Challenger l’équipe sur les solutions proposées en s’appuyant sur son expertise Ops.
- Remonter les feedbacks vers les équipes OPS pour identifier les prochaines fonctionnalités des composants d’infrastructure à développer.
- Participer à la mise en place des Jalons Qualités (Quality Gates).
- Anticiper les problématiques de conformité aux règles et standards d’architecture, de sécurité, de délais de livraisons et de mise à l’échelle des solutions proposées.
- Obtenir et gérer les ressources techniques en tant que référent.
- Implémenter et surveiller l’utilisation des services de production (OpStore…).
- Assurer la traçabilité des accès aux machines (OS, espace de stockage, routeurs…).
- Tester l’exploitabilité des environnements techniques (backup/restore, accès aux données, performances…).
- Identifier les points de blocage Ops (flux, sécurité, réseau…) puis alerter et proposer des plans d’action.
- Implémenter la surveillance et la supervision des ressources d’infrastructures.
- Participer à l’amélioration des outils de surveillance et supervision.
- Communiquer l’analyse des résultats à l’équipe.
- Proposer des ajustements concernant les indicateurs de pilotage des produits.
- Veiller à la disponibilité d’une documentation d’installation et d’exploitation à jour et validée.
- Contribuer à la gestion des incidents.
- Contribuer à la gestion des problèmes (Time to fix / Time to repair - Réparation de la cause qui a généré l’incident).
- Appliquer les principes du continuous operations / exploitation.
- Définir et promouvoir des solutions techniques alignées sur les produits et services existants, en intégrant exigences de production, de sécurité et de résilience.
- Assembler les composants d’infrastructure et de production pour répondre aux besoins applicatifs, tout en anticipant conformité, délais et capacité d’évolution.
- Assurer le déploiement fluide des solutions, la validation de leur exploitabilité et la conformité aux standards de sécurité.
- Piloter l’excellence opérationnelle au cœur des projets métiers.
Compétences techniques avancées
- Dynatrace : configuration, surveillance des performances, analyse des métriques et résolution d’incidents en environnements complexes.
- ServiceNow (Snow) : gestion des incidents, changements et problèmes ; création de tableaux de bord pertinents.
- Kubernetes : déploiement et orchestration de conteneurs, administration des clusters (scaling, monitoring, sécurité) ; intégration CI/CD.
- CI/CD : maîtrise des pipelines avec GitLab‑CI, Jenkins ou Ansible.
- Infrastructure as Code : mise en œuvre de déploiements cloud via Terraform.
- Conteneurisation : déploiement d’applications avec Docker, Kubernetes et gestion des secrets avec HashiCorp Vault.
- Automation : conception de flux CFT et jobs Autosys.
- Connaissance en Infrastructure Cloud (IaaS, PaaS) et d'applications Open.
- Connaissance de l'intégration continue (Continuous Intégration) : outil de gestion de version, référentiel du code source (GitLab, Bitbucket, ...), référentiel binaire (Nexus, Artifactory, ...), orchestration (Jenkins, ...), et de la livraison continue : gestion de configuration d'environnement, déploiement, infrastructure as code (Ansible, Puppet, Chef).
- Maîtrise du scripting.
- Maîtrise de l'ordonnancement (Schedulers).
Reporting & coordination
- Reporting hebdomadaire (avancement du plan d’action, identification des risques, suivi des jalons).
- Interface de communication directe avec les différents intervenants (métiers, équipes techniques).
- Coordination et création d’items ticketing pour des projets de faible volume et de criticité maîtrisée.