Missions
- Maintien en conditions opérationnelles des activités métiers sur les différents environnements Production et Hors Production
- Traitement des demandes techniques de mise en œuvre applicative en appliquant les règles et standards en vigueur au sein du département (installations, mises à jour, décommissionnements, ...)
- Prise en charge, tout ou partie, de la mise en œuvre opérationnelle de l’application (installation, exploitabilité)
- Rédaction des documentations techniques
- Support au service exploitation afin de diagnostiquer et analyser les dysfonctionnements/incidents techniques sur les briques mises en œuvre et proposer des solutions de résolution
- Reporting
Contexte
L'Ingénieur OPS intervient au sein d'une équipe mode Agile (Scrum), autonome et pluridisciplinaire, composée de ressources IT métiers (les « Dev ») et de ressources OPS, responsabilisées autour d’un ou plusieurs produits.
Dans ce cadre, il :
- Participe à l’ensemble des rituels Agile (Sprint planning, Daily Meeting, Review, Rétro)
- Communique des exigences infrastructure et exploitation dans le product backlog
- Participe à l’évaluation de la complexité des User Stories lors des sprint planning
- Implémente les User Stories techniques et d’exploitation du Product Backlog
- Réalise durant le sprint de façon autonome les tâches relatives à la production, ou bien coordonne les parties prenantes « Production Mutualisée » extérieures à l'équipe Agile pour laquelle il intervient
- Déclare les obstacles (impediments) et les remonte aux bons interlocuteurs
Supporter les bonnes pratiques OPS
- Assurer la montée en compétence de l’équipe Agile sur les bonnes pratiques DevOps (Profil confirmé et Senior)
- Sensibiliser et propager les bonnes pratiques OPS au sein de l’équipe
- Faire monter en compétence les membres de son équipe sur les outils d’exploitation mis à disposition dans le cadre DevOps
- Promouvoir les solutions standards ou expérimentales répondant aux problématiques de l’équipe ou orienter vers les architectes
- Challenger l’équipe sur les solutions proposées en s’appuyant sur son expertise Ops
Contribuer à l'enrichissement du backlog des fonctions OPS
- Remonter les feedbacks vers les équipes OPS pour identifier les prochaines fonctionnalités des composants d’infrastructure à développer
Faciliter les déploiements
- Participer à la mise en place des Jalons Qualités (Quality Gates)
Contribuer à la mise à disposition des ressources d’infrastructure
- Anticiper les problématiques de conformité aux règles et standards d’architecture, de sécurité, de délais de livraisons et de mise à l’échelle des solutions proposées
- Obtenir et gérer les ressources techniques en tant que référent
- Implémenter et surveiller l’utilisation des services de production (OpStore…)
- Assurer la traçabilité des accès aux machines (OS, Espace de stockage, routeurs …)
- Tester l’exploitabilité des environnements techniques (backup/restore, accès aux données, performances…)
- Identifier les points de blocage Ops (flux, sécurité, réseau…) puis alerter et proposer des plans d’action
Contribuer au Maintien en Conditions Opérationnelles (MCO) du Produit
- Implémenter la surveillance et la supervision des ressources d’infrastructures
- Participer à l’amélioration des outils de surveillance et supervision
- Communiquer l’analyse des résultats à l’équipe
- Proposer des ajustements concernant les indicateurs de pilotage des produits
- Veiller à la disponibilité d’une documentation d’installation et d’exploitation à jour et validée
- Contribuer à la gestion des incidents
- Contribuer à la gestion des problèmes (Time to fix / Time to repair - Réparation de la cause qui a généré l’incident)
- Appliquer les principes du continuous operations / exploitation
Outils & Environnement
- Connaissance en Infrastructure Cloud (IaaS, PaaS) et d'applications Open
- Connaissance de l'intégration Continue (Continuous Intégration) : outil de gestion de version, référentiel du code source (GitLab, Bit bucket, ...), référentiel binaire (Nexus, Artifactory, ...), orchestration (Jenkins, ...)
- Connaissance de la livraison continue : gestion de configuration d'environnement, déploiement, infrastructure as code (Ansible, Puppet, Chef)
- Maîtrise du scripting
- Maîtrise de l'ordonnancement (Schedulers)
Expérience
- 9 ans et plus dans l'environnement de la prestation