Rejoignez une entreprise à la pointe de l’innovation en tant qu’Ingénieur SRE / Cloud ! Vous serez le garant de la fiabilité, de la performance, de la disponibilité et de la sécurité des services en production. En télétravail intégral, vous aurez un rôle clé dans l’évolution de notre infrastructure et des pratiques SRE.
Vos missions principales
Votre mission : assurer la robustesse et la performance des services en production tout en faisant évoluer l’infrastructure et les méthodes SRE.
Vous interviendrez en toute autonomie sur l’ensemble du cycle de vie de l’infrastructure, de l’automatisation à l’exploitation.
- Concevoir, maintenir et faire évoluer l’infrastructure AWS en production
- Automatiser l’infrastructure avec Terraform
- Optimiser et maintenir les pipelines CI/CD
- Gérer et améliorer les environnements conteneurisés via Kubernetes et/ou ECS
- Développer l’observabilité : métriques, logs, traces, dashboards et alertes
- Définir et suivre les SLI / SLO
- Transformer les enjeux de disponibilité en solutions concrètes (monitoring, redondance, déploiement)
- Gérer les incidents de production, analyser les causes racines et rédiger les post-mortems
- Renforcer la sécurité de l’infrastructure, notamment la gestion des accès et des secrets
- Automatiser les tâches répétitives pour limiter les interventions manuelles
- Accompagner les équipes de développement sur les problématiques d’infrastructure et de production
- Proposer et mettre en œuvre des améliorations en fiabilité, performance, sécurité et optimisation des coûts Cloud
- Mettre à jour les runbooks, la documentation et les bonnes pratiques SRE
Profil recherché
Formation & expérience :
- 5 à 6 ans d’expérience en SRE, undefined, Cloud ou ingénierie infrastructure
- Expertise confirmée sur AWS en production
- Expérience sur des systèmes critiques en disponibilité, fiabilité et performance
- Habitude de gérer des incidents de production et d’en analyser les causes
- Solide culture Cloud, infrastructure et production
- Aisance à collaborer avec des équipes Engineering et Product
- Anglais courant, indispensable pour évoluer dans un contexte international
Compétences techniques indispensables :
- AWS : VPC, EC2/ECS/EKS, RDS, S3, IAM, Load Balancers, Route 53, CloudWatch
- Terraform et Infrastructure as Code en production
- Kubernetes et/ou ECS
- CI/CD
- Monitoring et observabilité : Grafana, Datadog, New Relic, CloudWatch
- Linux, réseau et DNS
- Scripting : Bash, python ou Go
- Gestion des secrets et sécurité
- Gestion d’incidents en production
Qualités humaines :
- Curiosité et volonté de comprendre la racine des problèmes plutôt que d’appliquer des correctifs superficiels
- Analyse rigoureuse des incidents et sang-froid face aux situations critiques
- Autonomie, esprit d’initiative et capacité à mener des projets d’amélioration à terme
- Culture forte de la fiabilité et anticipation des risques
- Compréhension de l’impact des choix d’infrastructure sur le produit et les utilisateurs
- Goût du travail collaboratif avec les développeurs pour faciliter leur quotidien
- Partage des connaissances et collaboration avec des profils techniques expérimentés
- Importance accordée à la documentation et aux runbooks
- À l’aise dans un environnement international et en télétravail
Conditions & avantages
- Télétravail intégral avec 2 jours d’équipe par mois, flexibilité pour venir au bureau à Paris
- Contrat CDI
- Rémunération entre 55 000 € et 60 000 € selon profil
- Bonus annuel
- Mutuelle
- Environnement international stimulant
- Équipe undefined expérimentée pour progresser continuellement
- Projets Cloud / SRE concrets, à fort impact et en autonomie
Avantages complémentaires
- 1 à 2 jours de télétravail par semaine
- Plan d’épargne entreprise (PEE)
- Prime de cooptation
- Incentives à long terme
- Plan d’achat d’actions / BSPCE / Stock options
- Team building, afterworks et déjeuners d’équipe
- Plan de développement professionnel et mentorat
- Remboursement des frais au-delà de 50%
Salaire : 55 000 € - 60 000 € annuel