Devoteam logo

Site Reliability Engineer & AI SRE

Devoteam

On-site
Levallois-Perret, FR
Full-time
Senior
5+ yrs
Salary not listedPosted 27m ago

Real job — pulled straight from Devoteam’s careers page · Verified October 1, 2026 · No reposts.

Job description

Devoteam is hiring a Site Reliability Engineer & AI SRE — a full-time, based in Levallois-Perret, FR role. Apply directly on Devoteam's careers page below.

Site Reliability Engineer & AI SRE (F/H)

Location: Levallois-Perret, IDF, fr

Description de l'entreprise

💡Devoteam Innovative Tech France accompagne nos clients dans leurs stratégies de modernisation de plateformes en s'appuyant sur les plus grands Cloud providers du marché et sur des technologies modernes innovantes. 

Notre communauté

  • + de 1000 collaborateurs experts de leur domaine répartis sous forme de Tribes et Squads, travaillant sur des projets multi-cloud et cloud hybride impactants

  • Des expertises techniques liées aux enjeux du secteur IT : Hybrid Platform, Cloud & DevOps Platform, FinOps & Agile@scale, Project et SysOps Automation 

  • Un environnement technologique stimulant, à travers nos partenaires : Gitlab, OVHcloud, VMware, SUSE, Dynatrace, Hashicorp, VEEAM, etc.

  • Une vraie communauté de Tech enthousiastes qui partagent leurs savoirs : événements, Friday Talks sur des sujets techniques, rédaction d'articles... 

Pour en savoir plus sur nos trajectoires de carrière, découvrez le parcours de Nisrine !

 

Description du poste

💪 Vos missions principales : En tant que Site Reliability Engineer (SRE) & AI SRE, vous concevez des écosystèmes résilients, définissez la culture de fiabilité et garantissez la haute disponibilité, la sécurité et l'automatisation des infrastructures critiques et des plateformes d'IA en production pour nos clients grands comptes :

  • Architecture & Résilience : Architecturer des socles Cloud (Landing Zones) et des plateformes distribuées haute disponibilité supportant aussi bien les applications critiques que les charges de travail d'IA (Kubernetes, GPU Scheduling, NVIDIA MIG, autoscaling).

  • Culture SRE & Gouvernance : Définir et piloter les engagements de service (SLI/SLO, Error Budgets), promouvoir le modèle "You build it, you run it", et implémenter la gouvernance des modèles d'IA (traçabilité, gestion des biais et hallucinations).

  • Gestion des Incidents & Chaos Engineering : Mener des analyses de causes profondes (RCA) assistées par l'AIOps lors d'incidents complexes (panne GPU, corruption de données) et éprouver les architectures via le Chaos Engineering.

  • Sécurité & Conformité IA : Déployer les stratégies de sécurité applicatives/infra et veiller à la conformité technique aux réglementations en vigueur (AI Act, RGPD, auditabilité).

  • Automatisation & CI/CD : Réduire la charge d'exploitation (toil) via l'automatisation et l'IaC (Terraform, Ansible, Python, Go, Bash), et moderniser les pipelines de déploiement continu (GitOps, Canary, Blue/Green).

Qualifications

👤 Profil recherché :

🎓 Formation & expérience :

  • Diplômé·e Bac+5 en informatique (ou équivalent).

  • Minimum 5 ans d'expérience globale sur des environnements de production à grande échelle, incluant une expertise reconnue en ingénierie SRE et/ou MLOps.

🧠 Compétences techniques indispensables :

  • Infrastructures & Conteneurs : Maîtrise de Kubernetes (K8s, GPU Scheduling, MIG), du Cloud (AWS, GCP, Azure, Privé/Souverain) et des architectures de Landing Zones.

  • Automatisation & IaC : Pratique avancée de Terraform, Ansible, GitOps (ArgoCD/Flux) et scripting (Python, Go, Bash).

  • Fiabilité & Observabilité SRE : Maitrise de la gestion des SLI/SLO/Error Budgets, de l'AIOps, du Chaos Engineering et des processus RCA.

  • Sécurité & Conformité IA : Connaissances des enjeux juridiques et de la sécurisation des plateformes d'IA (AI Act, RGPD, gestion des secrets et des accès aux modèles).

🤝 Qualités personnelles :

  • Leadership, esprit de mentorat et capacité d'influence/évangélisation auprès des équipes (Dev, Ops, Data).

  • Sens de l'analyse, rigueur éthique et grande résistance au stress en gestion de crise.

  • Orientation résolution de problèmes et recherche d'efficacité.

⭐ Atouts appréciés :

  • Certifications SRE & Cloud : SRE Foundation, HashiCorp Terraform Associate, AWS DevOps Engineer Pro ou Google Cloud Professional DevOps Engineer.

  • Certifications Kubernetes : CKA (Kubernetes Administrator), CKS (Kubernetes Security Specialist).

  • Connaissances théoriques et pratiques sur les bases "Safe AI Native Foundations".

Informations supplémentaires

🤝Comment se déroule le processus de recrutement chez Devoteam ? 

Il comporte 2 à 3 entretiens :

- Talent Acquisition Interview : l'objectif est de faire le point sur vos compétences, votre niveau d'anglais et de valider vos éléments de motivation
- Tech & Business Interview : cet entretien vise à approfondir vos compétences techniques et à vérifier leur adéquation avec nos besoins lors d'un échange avec un expert métier
- Leadership Interview : il permet d'évaluer votre potentiel, vos ambitions et d'envisager votre évolution au sein de Devoteam.
Nous privilégions au moins un entretien en présentiel. Une prise de référence est demandée et, selon votre profil, des tests (techniques, anglais, personnalité...) peuvent vous être adressés.

✍️ Si votre candidature est retenue, nous vous faisons parvenir une proposition présentant les conditions d'embauche. En cas d'acceptation, le contrat de travail est formalisé.

Le Groupe Devoteam oeuvre pour l'égalité des chances, pour la promotion de ses collaboratrices et de ses collaborateurs au mérite et lutte activement contre toute forme de discrimination. Nous sommes convaincus que la diversité contribue à la créativité, au dynamisme et à l'excellence de notre organisation. Chaque candidature est donc considérée indépendamment de tout critère discriminatoire.

Si vous partagez notre passion pour la technologie et que vous souhaitez construire le monde numérique responsable de demain, alors vous êtes peut-être le passionné que nous recherchons chez Devoteam.

Get Site Reliability Engineer jobs like this→

New roles from thousands of companies land hourly, straight from their careers pages. Get the freshest matches by email so you never miss one.

Email me new jobs
Theodo logo

Software Engineering Manager

Casablanca
✓ From careers page· 14h ago
LiveRamp logo

Staff Software Engineer

$157k–$235kSan Francisco, CA
✓ From careers page· 14h ago
LiveRamp logo

Senior Technical Lead Manager

Hyderabad
✓ From careers page· 14h ago
Cartesia logo

Research Engineer, Data Infrastructure (Language Modeling)

$200k–$350kSan Francisco, CA
✓ From careers page· 15h ago

Frequently asked questions

What skills are required for Site Reliability Engineer & AI SRE at Devoteam?

The required skills for Site Reliability Engineer & AI SRE at Devoteam include: Kubernetes, Terraform, Ansible, Python, Go, Bash, ArgoCD, AWS, GCP, Azure.

What is the seniority level for Site Reliability Engineer & AI SRE at Devoteam?

Site Reliability Engineer & AI SRE at Devoteam is a Senior level position.

How do I apply for Site Reliability Engineer & AI SRE at Devoteam?

You can view the full description and apply for Site Reliability Engineer & AI SRE at Devoteam on EchoJobs: https://echojobs.io/job/devoteam-site-reliability-engineer-ai-sre-f-h-dte49.