OmDev Logo
GetYourJob
0
Publié aujourd'hui

Consultant SRE - IA - Freelance (H/F)

Entreprise
Collective workPlateforme freelance
Localisation
Paris
Sur site
Type de contrat
Freelance
Niveau
Junior

Salaire du marché

Médiane du marché
385€/j
Estimation
285€/jfourchette habituelle455€/j

Cette offre n'affiche pas de TJM. D'après 10 offres pour ce poste (Junior, France), le marché se situe autour de 385€/j (285€/j–455€/j).

TJM du marché pour DevOps (Junior) en France : médiane 385 €/jour, P25–P75 : 285–455 €/jour, n = 10 offres. TJM Python à Paris

Baromètre TJM et salaires IT

Description du poste

Taux journalier (TJM): -600
Dans le cadre du développement et de l'industrialisation d'une plateforme dédiée à l'IA agentique, le consultant intégrera une équipe en charge du socle technique permettant de déployer, superviser et exploiter des agents IA en production.
L'objectif de la mission est de garantir la fiabilité, la disponibilité, la performance, la sécurité et l'exploitabilité de cette plateforme, tout en assurant sa portabilité entre différents environnements.
* Garantir la robustesse et l'exploitabilité d'un environnement Kubernetes de production.
* Mettre en œuvre les pratiques SRE adaptées à une plateforme critique.
* Définir et suivre les SLI/SLO de la plateforme.
* Garantir la disponibilité, la capacité, la résilience, la sauvegarde et la reprise.
* Mettre en place une observabilité de bout en bout des services et composants.
* Industrialiser les mécanismes de supervision, d'alerting et de remédiation.
* Construire les dashboards opérationnels et les indicateurs de suivi.
* Industrialiser les manifests, charts et pipelines de déploiement.
* Garantir la compatibilité des déploiements entre les différents environnements.
* Mettre en œuvre les pratiques CI/CD et GitOps.
* Contribuer à la sécurisation des workloads, des secrets, des accès API et des politiques réseau.
* Garantir la portabilité et l'agnosticité de l'infrastructure.
* Mettre en place et exploiter une chaîne OpenTelemetry pour les traces, métriques et logs.
* Construire les systèmes d'alerting associés aux services et aux agents.
* Préparer les mécanismes nécessaires aux analyses post-incident et à l'amélioration continue.
* Formaliser les procédures de mise en production, rollback, gestion des incidents et exploitation.
* Rédiger et maintenir les runbooks d'exploitation.
* Accompagner les équipes dans l'adoption des pratiques SRE et d'exploitation.
* Participer aux instances de suivi et de pilotage.
* Assurer la mise à jour des outils de suivi et de la documentation technique.
* Interventions ponctuelles en horaires décalés lors des mises en production ou opérations sensibles.
* Déplacements occasionnels possibles.
* Plateforme agentique industrialisée et exploitable en production.
* Définition et suivi des SLI/SLO.
* Dashboards de supervision et de pilotage opérationnel.
* Systèmes d'alerting.
* Chaîne d'observabilité basée sur OpenTelemetry.
* Runbooks d'exploitation.
* Procédures de mise en production et de rollback.
* Documentation d'architecture technique.
* Documentation des pratiques d'exploitation et de supervision.
* Outils et tableaux de suivi régulièrement mis à jour.
* Kubernetes
* Grafana
* CI/CD
* Linux
* Cloud
* Réseaux
* Sécurité des plateformes
* Python et/ou Go
* Manifests et charts de déploiement
* Pipelines multi-environnements
* Gestion des secrets
* Policies réseau
* Observabilité : traces, métriques et logs
* Environnements de production critiques
* Poste : SRE
* Expérience requise : Plus de 7 ans
1.
Plus de 7 ans d'expérience
2.
Expérience significative sur Kubernetes en environnement de production
3.
Maîtrise de l'exploitation de plateformes critiques et des pratiques SRE
4.
Compétences en définition, suivi et amélioration des SLI/SLO
5.
Conception de solutions d'observabilité avec OpenTelemetry
6.
Mise en place de dashboards et d'alerting avec Grafana
7.
Pratiques CI/CD et GitOps
8.
Connaissances en Linux, réseaux et sécurité des plateformes
9.
Expérience avec les environnements cloud et architectures agnostiques
10.
Développement de scripts ou outils d'automatisation en Python et/ou Go
11.
Industrialisation des déploiements et gestion dans des environnements multiples
12.
Gestion des incidents, des mises en production

Exigences du poste

Compétences requises

  • Python
  • Go
  • Kubernetes
  • Grafana
  • OpenTelemetry
  • Continuous Improvement
  • Artificial Intelligence
  • Agentic AI / Agents IA

Un plus

  • SRE
  • Monitoring / Observability
  • GitOps
  • API Development
  • Linux Administration
  • Cloud
  • Network Administration
  • Cybersecurity
  • Automation
  • CI/CD
  • Gestion des incidents
  • PKI

Toutes les offres Python à Paris

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

Collective workPlateforme freelance
Voir toutes les offres de Collective work

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.