Basé sur 28 offres pour ce poste (Mid, Toulouse, 3 dernières semaines). Fourchette habituelle 38k€–45k€, médiane 42k€. Cette offre (54k€) est au-dessus de la fourchette.
Pour accompagner l’évolution de notre plateforme SaaS, nous recherchons notre nouveau/nouvelle SRE pour prendre le lead sur la gestion opérationnelle et l’automatisation de notre infrastructure.
Vous rejoignez l’équipe pour travailler en binôme direct et en synergie avec notre Architecte plateforme : il impulse la vision macro et les choix d’architecture globale, vous êtes le maître d’œuvre de la fiabilité, de l’excellence opérationnelle et de l’automatisation.
Dans un contexte de montée en charge et d’un recours croissant aux workloads IA, votre rôle sera stratégique pour anticiper nos futurs défis de scalabilité et de performance.
Véritable force de proposition et doté(e) d’une grande autonomie, vos responsabilités s’articulent autour de trois piliers :
1. Fiabilité, Observabilité & Run (SRE)
Garantir l’observabilité globale du système, définir et suivre les indicateurs clés (SLIs / SLOs).
Piloter la gestion et la résolution des incidents de production en étroite collaboration avec l’équipe de développement.
Assurer la robustesse de la plateforme via la maintenance et le test des plans de continuité et de reprise d’activité (PCA / PRA).
Diffuser et infuser la culture SRE auprès des équipes de dev.
2. Architecture, Automatisation & Projets IA (DevOps / Next-Gen)
Maintenir, optimiser et faire évoluer notre infrastructure Cloud via une approche GitOps / IaC rigoureuse.
Collaborer avec l’Architecte pour concevoir des solutions cloud scalables et hautement disponibles.
Participer activement aux réflexions architecturales sur la mise à l’échelle de nos fonctionnalités IA (hosting des modèles, optimisation du compute, gestion des ressources).
3. Amélioration Opérationnelle (SecOps & FinOps)
Garantir la posture de sécurité du cloud (gestion des vulnérabilités, détection et mitigation des menaces).
Piloter l’optimisation continue des coûts d’infrastructure (FinOps).
Cloud : AWS, OVHCloud
Orchestration & CI/CD : Docker, Kubernetes, Gitlab, ArgoCD, Helm, Terraform, Istio
Monitoring & Observabilité : Datadog, Sentry
Environnement Dev & Data : NodeJS (Express), Kafka, MongoDB, S3, Meilisearch
IA : Écosystème LLM (Langchain, Mistral) côté produit, et automatisation interne augmentée par l’IA (Claude + MCPs).
Un binôme de haut niveau : Un cadre stimulant pour échanger quotidiennement avec un Principal Engineer et co-construire l’infra de demain.
Un terrain de jeu innovant : L’opportunité d’industrialiser des architectures intégrant des LLM et d’utiliser l’IA (MCP) pour votre propre automatisation.
Flexibilité : Télétravail partiel accordé (jusqu’à 3 jours par semaine) et horaires flexibles.
Cadre de travail unique : Des bureaux modernes en plein centre-ville de Toulouse (Village by CA 31), au pied des transports en commun (métro, bus, tramway) et des commerces.
Contrat : CDI, Temps plein.
Astreintes : Participation requise aux astreintes de production (selon planning d’équipe, avec un système de compensation financière attractif).
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.