Site Reliability Engineer
Ingénieur SRE
Montreuillead
Apply on the employer's siteRole description
Vous intégrez l'équipe
APS PF
en tant qu'
Ingénieur SRE (Site Reliability Engineer)
, garant de la disponibilité, de la performance et de la résilience de la plateforme de production.
Au carrefour du développement et de l'exploitation, vous portez une
culture DevOps forte
: vous partagez avec les équipes de développement des objectifs communs de fiabilité, vous intervenez dès les phases de cadrage des projets, et vous avez une vision de bout en bout sur l'ensemble des opérations impactant votre périmètre (incidents, mises en production, changements, obsolescence…).
Votre credo :
anticiper plutôt que réagir
, automatiser plutôt que subir, et transformer la donnée en décision.
Vos responsabilités au quotidien
Maintien des objectifs de niveau de service
- Garant de la disponibilité, l'intégrité, la résilience et la qualité de la plateforme
- Pilotage de la remise en service lors d'incidents, avec mobilisation des bonnes ressources
Une culture DevOps au service de l'innovation
- Collaboration étroite avec les équipes de développement et d'exploitation
- Anticipation des impacts des changements à venir sur la production
- Partage des contraintes opérationnelles dès l'amont des projets
Monitoring & Alerting
- Mise en place du bon niveau de monitoring et d'alerting
- Construction de tableaux de bord pertinents pour éclairer la prise de décision
Amélioration continue & mise à l'échelle
- Identification et priorisation des chantiers d'automatisation et d'industrialisation
- Développement de scripts et outillage des opérations, avec le souci de la maintenabilité
Sécurité & gestion de l'obsolescence
- Pilotage de l'obsolescence et des non-conformités
- Priorisation budgétaire en coordination avec les équipes produit et l'IT métier
Votre profil
Compétences techniques
- Monitoring & observabilité : Prometheus, Grafana, Datadog, ELK, Dynatrace…
- Scripting & automatisation : Python, Bash, Ansible, Terraform
- CI/CD : Jenkins, GitLab CI, Azure DevOps
- Environnements cloud et/ou on-premise (AWS, Azure, GCP)
- Notions de gestion d'incidents (ITIL) et de sécurité en production
Compétences transverses
- Sens des priorités et rigueur, notamment en gestion de crise
- Capacité à travailler en amont, en mode proactif
- Aisance relationnelle avec les équipes Dev, Ops et Métier
- Autonomie et esprit d'initiative
Expérience
- 3 à 8 ans d'expérience en exploitation, production ou développement, avec une appétence marquée pour la fiabilité et l'automatisation
Pourquoi nous rejoindre ?
- Un rôle clé à l'interface Dev/Ops, au cœur de la performance et de la résilience de la production
- Une équipe engagée dans une démarche SRE/DevOps mature
- Des projets concrets d'automatisation et d'industrialisation à fort impact
- Une réelle autonomie dans la priorisation et le pilotage de votre périmètre
Profil candidat:
Votre profil
Compétences techniques
- Monitoring & observabilité : Prometheus, Grafana, Datadog, ELK, Dynatrace…
- Scripting & automatisation : Python, Bash, Ansible, Terraform
- CI/CD : Jenkins, GitLab CI, Azure DevOps
- Environnements cloud et/ou on-premise (AWS, Azure, GCP)
- Notions de gestion d'incidents (ITIL) et de sécurité en production
Compétences transverses
- Sens des priorités et rigueur, notamment en gestion de crise
- Capacité à travailler en amont, en mode proactif
- Aisance relationnelle avec les équipes Dev, Ops et Métier
- Autonomie et esprit d'initiative
Expérience
- 3 à 8 ans d'expérience en exploitation, production ou développement, avec une appétence marquée pour la fiabilité et l'automatisation
This is a saved copy of a posting published elsewhere. Postings get taken down without notice — check the employer's site before applying. mentors.coach is not the hiring party.