Basé sur 18 offres pour ce poste (tous niveaux, Lille, 3 dernières semaines). Fourchette habituelle 360€/j–490€/j, médiane 430€/j. Cette offre (515€/j) est au-dessus de la fourchette.
Le projet vise à améliorer les pratiques Ops grâce à l’IA générative. L’objectif est d’optimiser la stabilité et la performance des produits digitaux, réduire le MTTD et MTTR en cas d’incident, tout en diminuant les coûts et la charge cognitive des Feature Teams.
Identifier, prototyper (POC) et industrialiser des outils, plateformes et pratiques intégrant la GenAI au cœur des opérations, en respectant les standards et le Tech Radar de l’entreprise.
Concevoir et développer des preuves de concept (POC) pour valider la pertinence de cas d’usage de la GenAI appliqués aux pratiques Ops.
Déployer, configurer, évaluer et intégrer des solutions pertinentes du marché.
Fiabiliser les solutions déployées pour les rendre opérables en production (évaluation continue, testing d’agents, gouvernance, observabilité, maîtrise des coûts, etc.).
Construire des solutions robustes, documenter les bonnes pratiques et contribuer activement à un référentiel de prompts centralisé et maintenu en "inner source".
Travailler en mode projet avec différentes équipes et produits pour comprendre leurs contextes, implémenter des solutions adaptées et assurer la transmission des POC réussis vers les équipes de production.
Participer activement à la définition de la stratégie "AI for Ops" en identifiant et évaluant de nouvelles opportunités (outils, modèles, approches).
Investigation d’incident : développement d’un agent autonome capable de remplacer l'expertise SRE lors des incidents critiques. En exploitant le Model Context Protocol (MCP), l’outil orchestre des workflows complexes entre Datadog, GitHub et Jira pour corréler télémétrie et code en temps réel. Ce workflow d’agentic IA formule des hypothèses allant jusqu’à la suggestion de la root cause.
Escalade efficace des tickets de support : en se basant sur la base de connaissances et l’historique des tickets, l’outil suggère le groupe le plus pertinent à qui escalader un ticket d’incident pour un temps de résolution minimal.
Python - confirmé - impératif
Frameworks de développement IA (adk, langchain, pydantic, ...) - confirmé - impératif
Pratiques DevOps (CI/CD, IaC, etc.) - confirmé - impératif
Culture SRE - confirmé - souhaitable
Maîtrise d’au moins un langage de programmation principal (ex : Java, Node.js, Python)
Connaissance pratique des API de modèles de langage (LLMs) et des techniques de prompt engineering
Expérience avec les environnements Cloud (GCP) et les outils CI/CD
Expérience de développement de server MCP
Anglais professionnel (impératif)
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.