Basé sur 11 offres pour ce poste (Senior, France, 3 dernières semaines). Fourchette habituelle 540€/j–600€/j, médiane 550€/j. Cette offre (500€/j) est sous la fourchette.
Notre client dans le secteur Transport et logistique recherche un/une Incident Manager /Ingénieur supportH/F
Description de la mission:
Au sein de l’équipe RUN, l’Ingénieur Support / Incident Manager est responsable du pilotage des incidents en production, du respect des engagements de service et de l’amélioration continue de la fiabilité de la plateforme.
Supervision et pilotage opérationnel
• Assurer la supervision quotidienne du SI : applications, interfaces, flux et infrastructures
• Concevoir, maintenir et faire évoluer les tableaux de bord de suivi opérationnel
• Analyser les indicateurs de performance et détecter de manière proactive les signaux faibles
• Garantir la cohérence et la fiabilité des KPI RUN : disponibilité, MTTR, volumétrie des incidents, respect des SLA
Gestion des incidents
• Prendre en charge les incidents escaladés par le support N1 et N2
• Qualifier, prioriser et coordonner la résolution des incidents
• Assurer le pilotage transverse des équipes contributrices : développement, infrastructure, partenaires
• Garantir le respect des SLA et des engagements contractuels
• Organiser et animer les cellules de crise si nécessaire
• Assurer la communication interne et externe sur l’état du service
Suivi du cycle de vie des incidents
• Assurer le suivi complet des incidents, de leur détection jusqu’au rétablissement définitif du service
• Documenter les causes racines (RCA) et capitaliser dans les outils de knowledge management
• Identifier et suivre les problèmes récurrents en production
• Maintenir et piloter le backlog des problèmes dans une logique de problem management
Accompagnement des mises en production
• Participer au suivi des mises en production et valider leur bon déroulement en environnement réel
• Anticiper et analyser les impacts potentiels sur la disponibilité ou la performance
• Organiser les dispositifs de surveillance renforcée post-MEP
• Coordonner les communications en cas d’indisponibilité planifiée ou incidentelle
Amélioration continue et robustesse de la plateforme
• Identifier les causes structurelles des incidents récurrents
• Proposer et piloter des actions correctives et préventives
• Collaborer étroitement avec les équipes de développement pour améliorer la qualité logicielle et la résilience de la plateforme
• Contribuer à la définition d’architectures plus robustes dans un contexte de croissance de l’activité
• Participer à l’amélioration des processus RUN : gestion des incidents, des problèmes et des changements
Objectifs et enjeux
• S’intégrer dans l’équipe Codes & Examens
• Adopter un esprit customer centric et quality first
• Améliorer la robustesse de la plateforme dans un contexte d’expansion rapide
• Veiller à la qualité des prestations réalisées
• Assurer la coordination entre les équipes de développement, métiers, hébergeur et autres entités SI
• Gérer les communications internes et externes concernant les mises en production et les incidents bloquants
• Produire les KPI permettant de mesurer la santé de l’application
Compétences / Qualités indispensables :
Gestion d’incidents en production, Supervision RUN et pilotage KPI/SLA, Architecture SI et APIs, logs applicatifs, SQL, scripting , python, linux
Compétences / Qualités qui seraient un + :
Compétences appréciées • Connaissance des méthodes Agiles • Connaissance d’un langage de développement tel que Vue.js • Certification ITIL • Maîtrise des enjeux de sécurité • Collaboration avec les équipes de test et assurance qualité du code • Connaissances des modèles et implémentations IA
Informations concernant le télétravail :
2 jours / semaines
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.