Operations Cloud Expert - Ingénieur Cloud DevOps (RUN AWS/GCP/Kubernetes)
Entreprise: Ascalium
Type de contrat: Intérim (Freelance)
Localisation: Nanterre (92) –
Télétravail partielSalaire: 65 000 – 70 000 € / an
Formation: Bac +5
Référence: 4053300
Contexte & Objectifs du Poste
Le client recherche un
Ingénieur Cloud/DevOps orienté production pour assurer la
stabilité, fiabilité et performance des systèmes en production dans un
environnement cloud hybride (AWS/GCP).
Focus principal :
- RUN opérationnel avec une forte dimension automatisation et industrialisation (IaC, CI/CD, scripting).
- Stack technique :
- Cloud: AWS + GCP
- Data & Messaging: Kafka, Elasticsearch, Couchbase
- Orchestration: Mesos (environnement legacy en migration vers le cloud)
Profil idéal :Capable de gérer la
complexité et l’hétérogénéité des infrastructures, avec une approche proactive pour :
1.
Garantir la disponibilité production (monitoring, gestion des incidents, astreinte PagerDuty).
2.
Automatiser les opérations (réduction de la dette manuelle via Terraform, Ansible, Python/Bash).
3.
Collaborer avec les équipes Dev pour améliorer la
déployabilité et l’exploitabilité des applications.
Missions Principales
1. Supervision & Disponibilité Production
- Monitoring 24/7 des systèmes via Grafana, Prometheus, Datadog, Stackdriver :
- Détection proactive des anomalies avant impact utilisateur.
- Création et maintenance des dashboards et alertes.
- Corrélation des événements pour le diagnostic d’incidents.
- Participation à l’astreinte on-call (PagerDuty) sur les systèmes critiques.
2. Gestion des Incidents
- Prise en charge des incidents production :
- Troubleshooting et RCA (Root Cause Analysis).
- Mise en œuvre d’actions correctives et préventives.
- Communication claire avec les équipes et le management en situation de crise.
3. Automatisation & Infrastructure as Code (IaC)
- Terraform en production :
- Maintenance des modules, state management, workspaces.
- Automatisation des opérations répétitives via Python et Bash :
- Déploiements, inventaire, vérification, reporting.
- Gestion de la configuration via Ansible.
- Maintenance des pipelines GitLab CI.
4. Exploitation des Environnements Conteneurisés & Plateformes
- Kubernetes en production :
- Déploiements, services, scaling HPA, troubleshooting (pods/nodes).
- Gestion des namespaces et RBAC.
- Kafka en production :
- Monitoring du lag consumer, gestion des topics/partitions.
- Diagnostic des incidents de streaming.
- Support opérationnel sur les bases de données :
- PostgreSQL, Elasticsearch, Couchbase (performances, sauvegardes, restaurations).
5. Réseau & Sécurité Cloud
- Gestion des VPN, NAT, routage IP, proxy et load balancing (AWS/GCP).
- Application des bonnes pratiques de sécurité :
- IAM, VPC, gestion des accès.
Profil Recherché :
- Expérience solide en Cloud (AWS/GCP), Kubernetes, Terraform.
- Maîtrise des outils de monitoring (Prometheus, Datadog, Grafana) et de CI/CD (GitLab).
- Compétences en scripting (Python/Bash) et automatisation (Ansible).
- Capacité à travailler en environnement complexe et hybride (legacy → cloud).
- Esprit d’équipe et réactivité pour la gestion des incidents.
Poste en intérim – Candidatures bienvenues !