Vous voulez contribuer à des projets uniques pour construire ensemble le cloud libre ? Allons-y !
Chez OVHcloud, nous sommes animés par la même volonté, celle de construire l’avenir ensemble pour défendre la liberté d’innover.

► Découvrez l’acteur majeur du cloud libre et responsable

DÉTAILS

CDI
IT, Technologie & Produit

ROUBAIX, FR, 59100 BREST, FR, 29200 CESSON-SEVIGNE, FR, 35510

Hybride
Hybride

VOTRE MISSION

Site Reliability Engineer Backup - F/H/N

 

Au sein de votre équipe #OneTeam

  • Vous rejoindrez notre équipe Backup, responsable de la gestion des solutions de Backup et Disaster Recovery au sein d'OVHcloud.
  • En tant que Site Reliability Engineer, vous serez en charge de la fiabilité, de l'observabilité et de l'automatisation de nos plateformes de sauvegarde et de reprise d'activité. Vous serez amené à travailler sur des développements liés à des projets également.
  • Vous travaillerez conjointement avec notre Technical Leader, qui gère la direction technique et les conceptions techniques de l'équipe, et avec notre Product Owner, qui définit le produit et le backlog. Vous travaillerez dans une équipe internationale au sein d'un environnement Agile.
  • Au sein d'OVHcloud, nous adoptons une approche de développement augmentée par l'IA, où l'IA générative est intégrée aux pratiques quotidiennes : conception, développement, tests, revue de code et documentation.

 

Vos principales responsabilités

  • Définir, mettre en place et maintenir les SLIs, SLOs et l'Error Budget Management de nos produits basé sur Veeam Backup & Replication, Zerto, Plakar.
  • Concevoir et améliorer l'observabilité de nos plateformes : monitoring, alerting, logging et tracing, avec une approche orientée symptômes et expérience client.
  • Automatiser les opérations récurrentes (réduction du toil) via l'Infrastructure as Code et le développement d'outillage interne.
  • Participer aux développements liés à nos projets.
  • Participer à la gestion des incidents : diagnostic, résolution, astreinte, et animation des post-mortems blameless avec suivi des actions correctives.
  • Contribuer à la conception d'architectures modernes, scalables et résilientes, en apportant la vision fiabilité dès la phase de design (capacity planning, tests de charge, chaos engineering).
  • Fiabiliser et industrialiser les chaînes de déploiement (CI/CD) de l'équipe.
  • Partager les pratiques SRE avec vos pairs et votre réseau (autres équipes SRE, support, ...).
  • Rechercher les meilleures technologies et idées disponibles au sein ou en dehors de la compagnie pour vos projets.
  • Concevoir, développer et faire évoluer des APIs REST et services backend, dans une approche API-first, en exploitant pleinement les capacités de l'IA générative.
  • Concevoir et déployer des workflows agentiques et des techniques de Prompt Engineering avancées pour automatiser et fiabiliser l'ensemble du cycle de vie logiciel, de la génération de code au monitoring d'exploitation.

 

Votre futur impact

 

Dans 6 mois

  • Vous aurez pris en main l'environnement technique, les pipelines CI/CD et l'architecture de la plateforme Backup & Disaster Recovery.
  • Vous aurez contribué à la définition des premiers SLI/SLO ainsi qu'à l'amélioration de l'observabilité sur l'un de nos produits clés.
  • Vous aurez participé au développement logiciel sur certains projets de l'équipe.
  • Vous aurez intégré l'IA générative dans vos processus quotidiens de développement et d'automatisation.

 

Et dans 1 an

  • Vous serez autonome sur la gestion, la fiabilité et la résolution d'incidents complexes sur nos plateformes en production.
  • Vous aurez automatisé une part significative des tâches récurrentes (toil) via l'IaC et l'outillage interne.
  • Vous jouerez un rôle moteur dans la conception d'architectures résilientes et le déploiement de workflows agentiques avancés.

 

Compétences requises :

  • Expérience de minimum 2 ans en tant que SRE, DevOps Engineer, Software Engineer dans un écosystème de production à grande échelle.
  • Solide maîtrise des environnements Linux et des réseaux (TCP/IP, DNS, load balancing).
  • Compétences en développement / scripting (Python, Go, Bash) appliquées à l'automatisation.
  • Expertise en Infrastructure as Code (Ansible, Terraform) et CI/CD.
  • Expérience des outils d'observabilité (Prometheus, Grafana, ELK ou équivalents).
  • Intéressé par l'IA et l'utilisation à grande échelle.
  • Anglais fluide ou natif est obligatoire.

 

C'est un +

  • Connaissance des solutions de Backup et Disaster Recovery (Veeam, Zerto, Plakar).
  • Connaissance des environnements de virtualisation (VMware vSphere, VMware Cloud Director) et de Kubernetes.
  • Connaissance des concepts de stockage (objet, bloc, snapshots, immutabilité).
  • Connaissance des mesures de sécurité (certifications, chiffrement, hardening).
  • Empathie, l'envie de découvrir / partager et motivation sont fortement attendus.

NOTRE PARCOURS DE RECRUTEMENT

1. Échange avec notre Talent Acquisition Specialist:  Lucie
2. Entretien avec le Manager:  Antoine

3. Cas pratique (si pertinent)
4. Rencontre avec un pair, un membre de l'équipe ou de la direction
5. Débriefing ensemble

NOS AVANTAGES ET BÉNÉFICES

✔︎ Une politique de télétravail hybride
✔︎ Un plan d'actionnariat salarié
✔︎ Un programme de reconnaissance de l'ancienneté
✔︎ Des subventions vacances et sport
✔︎ Berceau et crèche d'entreprise (selon site)

Mais aussi :
✔︎ Des équipes multiculturelles
✔︎ Des locaux bien équipés 
✔︎ Une plateforme de formation et de certification en ligne
✔︎ Une offre d'accompagnement médical et social digitalisée pour vous et votre famille

REJOINDRE L’AVENTURE OVHCLOUD

OVHcloud valorise la diversité des personnes qu’elle embauche et accompagne.
La diversité pour nous, c’est favoriser un milieu de travail où les différences individuelles sont reconnues, appréciées et respectées de façon à développer le plein potentiel et les forces de chacune et chacun.
Soyez libre d’être vous-même !

L'IA DANS L'ADN

L'intelligence artificielle réinvente nos métiers au quotidien.
Rejoignez-nous pour explorer ses immenses possibilités et coconstruire l'avenir !

LE DÉVELOPPEMENT DURABLE CHEZ OVHCLOUD, UN ENGAGEMENT PROFOND

► Explorez nos engagements qui font la différence

À CHACUNE SON POTENTIEL, OSEZ POSTULER !

Nous savons que les femmes peuvent parfois s'abstenir de postuler si elles ne répondent pas à 100% des critères d'une offre.
Nous souhaitons clarifier : nos fiches de poste sont des repères, pas des barrières. Nous avons hâte de recevoir votre candidature.

Cette offre ne répond pas tout à fait à vos attentes ? Candidatez malgré tout !
C'est l'occasion de partager votre profil avec nos recruteurs, vous faire remarquer et peut-être recontacter pour une autre opportunité.

Cette offre ne répond pas tout à fait à vos attentes ? Candidatez spontanément sur le portail candidat pour rejoindre l'une de nos équipes !
L'occasion de partager votre profil avec nos recruteurs, vous faire remarquer et peut-être recontacter pour une autre opportunité.

Vous voulez contribuer à des projets uniques pour construire ensemble le cloud libre ? Allons-y ! Chez OVHcloud, nous sommes animés par la même volonté, celle de construire l’avenir ensemble pour défendre la liberté d’innover.

► Découvrez l'acteur majeur du cloud libre et responsable

VOTRE MISSION

Site Reliability Engineer Backup - F/H/N

 

Au sein de votre équipe #OneTeam

  • Vous rejoindrez notre équipe Backup, responsable de la gestion des solutions de Backup et Disaster Recovery au sein d'OVHcloud.
  • En tant que Site Reliability Engineer, vous serez en charge de la fiabilité, de l'observabilité et de l'automatisation de nos plateformes de sauvegarde et de reprise d'activité. Vous serez amené à travailler sur des développements liés à des projets également.
  • Vous travaillerez conjointement avec notre Technical Leader, qui gère la direction technique et les conceptions techniques de l'équipe, et avec notre Product Owner, qui définit le produit et le backlog. Vous travaillerez dans une équipe internationale au sein d'un environnement Agile.
  • Au sein d'OVHcloud, nous adoptons une approche de développement augmentée par l'IA, où l'IA générative est intégrée aux pratiques quotidiennes : conception, développement, tests, revue de code et documentation.

 

Vos principales responsabilités

  • Définir, mettre en place et maintenir les SLIs, SLOs et l'Error Budget Management de nos produits basé sur Veeam Backup & Replication, Zerto, Plakar.
  • Concevoir et améliorer l'observabilité de nos plateformes : monitoring, alerting, logging et tracing, avec une approche orientée symptômes et expérience client.
  • Automatiser les opérations récurrentes (réduction du toil) via l'Infrastructure as Code et le développement d'outillage interne.
  • Participer aux développements liés à nos projets.
  • Participer à la gestion des incidents : diagnostic, résolution, astreinte, et animation des post-mortems blameless avec suivi des actions correctives.
  • Contribuer à la conception d'architectures modernes, scalables et résilientes, en apportant la vision fiabilité dès la phase de design (capacity planning, tests de charge, chaos engineering).
  • Fiabiliser et industrialiser les chaînes de déploiement (CI/CD) de l'équipe.
  • Partager les pratiques SRE avec vos pairs et votre réseau (autres équipes SRE, support, ...).
  • Rechercher les meilleures technologies et idées disponibles au sein ou en dehors de la compagnie pour vos projets.
  • Concevoir, développer et faire évoluer des APIs REST et services backend, dans une approche API-first, en exploitant pleinement les capacités de l'IA générative.
  • Concevoir et déployer des workflows agentiques et des techniques de Prompt Engineering avancées pour automatiser et fiabiliser l'ensemble du cycle de vie logiciel, de la génération de code au monitoring d'exploitation.

 

Votre futur impact

 

Dans 6 mois

  • Vous aurez pris en main l'environnement technique, les pipelines CI/CD et l'architecture de la plateforme Backup & Disaster Recovery.
  • Vous aurez contribué à la définition des premiers SLI/SLO ainsi qu'à l'amélioration de l'observabilité sur l'un de nos produits clés.
  • Vous aurez participé au développement logiciel sur certains projets de l'équipe.
  • Vous aurez intégré l'IA générative dans vos processus quotidiens de développement et d'automatisation.

 

Et dans 1 an

  • Vous serez autonome sur la gestion, la fiabilité et la résolution d'incidents complexes sur nos plateformes en production.
  • Vous aurez automatisé une part significative des tâches récurrentes (toil) via l'IaC et l'outillage interne.
  • Vous jouerez un rôle moteur dans la conception d'architectures résilientes et le déploiement de workflows agentiques avancés.

 

Compétences requises :

  • Expérience de minimum 2 ans en tant que SRE, DevOps Engineer, Software Engineer dans un écosystème de production à grande échelle.
  • Solide maîtrise des environnements Linux et des réseaux (TCP/IP, DNS, load balancing).
  • Compétences en développement / scripting (Python, Go, Bash) appliquées à l'automatisation.
  • Expertise en Infrastructure as Code (Ansible, Terraform) et CI/CD.
  • Expérience des outils d'observabilité (Prometheus, Grafana, ELK ou équivalents).
  • Intéressé par l'IA et l'utilisation à grande échelle.
  • Anglais fluide ou natif est obligatoire.

 

C'est un +

  • Connaissance des solutions de Backup et Disaster Recovery (Veeam, Zerto, Plakar).
  • Connaissance des environnements de virtualisation (VMware vSphere, VMware Cloud Director) et de Kubernetes.
  • Connaissance des concepts de stockage (objet, bloc, snapshots, immutabilité).
  • Connaissance des mesures de sécurité (certifications, chiffrement, hardening).
  • Empathie, l'envie de découvrir / partager et motivation sont fortement attendus.

Cette offre ne répond pas tout à fait à vos attentes ? Candidatez malgré tout !
C'est l'occasion de partager votre profil avec nos recruteurs, vous faire remarquer et peut-être recontacter pour une autre opportunité.

Cette offre ne répond pas tout à fait à vos attentes ? Candidatez spontanément sur le portail candidat pour rejoindre l'une de nos équipes !
L'occasion de partager votre profil avec nos recruteurs, vous faire remarquer et peut-être recontacter pour une autre opportunité.