Expertises
il y a 17 heures
Opportunité exclusive
Publié par un Top Recruteur
Partagez cette opportunité
Partagez cette opportunité à quelqu’un de votre réseau :
✓ Offrez-lui un boost de visibilité auprès du client.
✓ Aidez vos contacts à trouver leur prochain job.
Information importante
Type de contrat:
Freelance
Taux journalier :
600-680€
Cette offre est à 0% de commission 🎉Localisation :
Paris, France
Date de démarrage :
Urgent
Mode de travail :
Hybride
Publié le :
21 juillet 2026
Le besoin
Vos missions
Concevoir, mettre en œuvre et maintenir des systèmes garantissant la disponibilité, la performance et la scalabilité de la plateforme
Définir et améliorer les SLO, SLA, le monitoring, l'alerting et les processus de gestion des incidents
Collaborer avec les parties prenantes produit et les équipes d'ingénierie pour construire des systèmes résilients et observables
Identifier et supprimer les goulots d'étranglement d'infrastructure à travers les services et environnements
Diriger les analyses de cause racine et piloter les post-mortems d'incidents et les améliorations de processus
Encadrer d'autres ingénieurs et promouvoir les bonnes pratiques SRE à l'échelle de l'entreprise
Contribuer à l'automatisation de l'infrastructure, à l'optimisation des coûts et à la planification de la capacité
Stack technique
AWS ; Kubernetes (EKS, Karpenter, ArgoCD) ; Terraform ; GitHub Actions (CI/CD) ; observabilité (Prometheus, Grafana, VictoriaMetrics, VictoriaLogs). Enjeu n°1 de la mission : le scaling GPU — comment scaler du GPU et lancer des trainings ML à large échelle. Bonus apprécié : data/MLOps, Airflow. Contexte : forte utilisation de Claude Code en interne, pas encore d'agents déployés mais intérêt marqué — une culture LLM/agentic est un vrai plus.
Profil recherché
Profil recherché
Must-have :
Expérience AWS/EKS récente et prouvée sur une mission concrète (dernière ou avant-dernière mission, pas une simple ligne de compétences) — c'est le critère filtrant principal : Karpenter idéalement, ou a minima autoscaling EKS avancé
ArgoCD/GitOps et Terraform en profondeur
Posture d'IC (Individual Contributor) senior autonome, capable de driver des projets seul — pas un profil manager en recherche d'équipe (vigilance sur les profils Head of/VP, sauf retour explicite vers un rôle IC)
Anglais courant obligatoire — la majorité des meetings engineering se tiennent en anglais
Bon relationnel : travail en binôme rapproché et communication transverse avec l'ensemble de l'engineering
6 ans d'expérience minimum en SRE, DevOps ou ingénierie infrastructure
Connaissance approfondie des plateformes cloud (AWS de préférence), des systèmes Linux et du réseau
Expérience des stacks d'observabilité (Prometheus, Grafana, Datadog ou équivalents) et de la gestion d'incidents
Solides compétences en programmation/scripting (Python, Bash, Go ou similaire)
Expérience de l'orchestration de conteneurs (Kubernetes) et des outils d'Infrastructure as Code (Terraform, Ansible…)
Différenciants forts :
Exposition GPU/ML : training à large échelle (Ray, Kueue, GPU-operator), à défaut serving (vLLM, KServe, Ollama)
VictoriaMetrics/VictoriaLogs (rarissime en prod)
Airflow, MLOps, culture agents/LLM
D'autres offres idéales pour vous !
Ces entreprises cherchent également d'excellents profils
Teksystems
Site Reliability Engineer (SRE) (H/F)
Freelance
Urgent
92130 Issy-les-Moulineaux, France
Hybride
Expertises
il y a 3 mois
Opportunité exclusive
Whub
Site Reliability Engineer (SRE) (H/F)
500€/jour - 650€/jour
Freelance
Urgent
Lille, France
Sur site
Expertises
il y a 2 mois
Opportunité exclusive
Metsys
Site Reliability Engineer H/F
550/600€
Freelance
Dans 4 à 8 semaines
Lyon, France
Hybride
Expertises
il y a 12 jours
Opportunité exclusive