Spécialiste SRE (Site Reliability Engineering)
About the role
Nous sommes à la recherche d'un(e) Spécialiste SRE (Site Reliability Engineering) pour contribuer à la fiabilité, à la disponibilité et à la performance de plateformes critiques dans un environnement technologique moderne. Vous jouerez un rôle clé dans l'automatisation des opérations, l'amélioration de l'observabilité des systèmes et l'évolution des pratiques DevOps. En collaboration avec les équipes de développement, d'architecture et d'exploitation, vous contribuerez à concevoir des solutions robustes, sécuritaires et hautement disponibles tout en favorisant l'amélioration continue des plateformes. Ce rôle s'adresse à une personne passionnée par l'automatisation, les infrastructures infonuagiques et les environnements distribués, qui souhaite avoir un impact concret sur la stabilité et la performance des systèmes.
Responsabilités principalesFiabilité et exploitation
Assurer la disponibilité, la stabilité et la résilience des plateformes critiques en production; Participer à l'amélioration continue de la performance, de la sécurité et de la fiabilité des environnements; Identifier les risques techniques et proposer des solutions durables pour assurer la pérennité des plateformes; Contribuer à la gestion des incidents, à l'analyse des causes fondamentales et à la mise en place d'actions préventives.
Automatisation et DevOps
Concevoir, développer et maintenir des solutions d'automatisation pour les infrastructures et les processus de déploiement; Développer et optimiser les pipelines d'intégration et de déploiement continus (CI/CD); Mettre en œuvre les pratiques d'infrastructure as Code (IaC) afin d'automatiser le provisionnement et la gestion des environnements; Automatiser les tests, les contrôles de qualité et les processus d'exploitation.
Observabilité et amélioration continue
Concevoir et faire évoluer les solutions d'observabilité, incluant les journaux, les métriques, les tableaux de bord et les alertes; Définir et suivre les indicateurs de disponibilité, de performance et de fiabilité (SLI, SLO, SLA); Collaborer avec les équipes de développement afin d'intégrer les meilleures pratiques SRE dès la conception des solutions; Participer à la planification technique, documenter les standards et promouvoir les bonnes pratiques d'exploitation.
Profil recherché
Détenir un baccalauréat en informatique, en génie logiciel ou dans un domaine connexe, ou posséder une expérience équivalente; Cumuler au moins cinq années d'expérience pertinente en SRE, DevOps, administration de systèmes ou exploitation de plateformes; Démontrer une solide expérience en automatisation, intégration et déploiement continus (CI/CD); Maîtriser les principes d'Infrastructure as Code (IaC); Posséder une excellente compréhension des environnements infonuagiques, distribués et hautement disponibles; Être reconnu(e) pour son esprit d'analyse, son autonomie et sa capacité à résoudre des problèmes complexes; Avoir d'excellentes aptitudes en collaboration et en communication avec des équipes multidisciplinaires.
Compétences techniques recherchées
Site Reliability Engineering (SRE) Infrastructure as Code (Terraform, Ansible) Docker Kubernetes Git CI/CD Java ou administration de systèmes Observabilité Splunk Datadog SonarQube AWS Atouts Expérience dans des environnements critiques à haute disponibilité; Connaissance des architectures distribuées et des microservices; Expérience en amélioration de la performance et de la résilience des plateformes; Certification AWS ; Connaissance des bonnes pratiques DevSecOps et des environnements infonuagiques. Pourquoi vous joindre à l'équipe? Contribuer à la fiabilité de plateformes critiques à grande échelle; Évoluer dans un environnement Agile misant sur l'automatisation et l'innovation; Travailler avec des technologies modernes en infonuagique, DevOps et observabilité; Collaborer avec des équipes multidisciplinaires sur des projets technologiques stratégiques; Développer votre expertise dans un environnement favorisant l'amélioration continue et l'évolution professionnelle.
Not the right fit? Search for Spécialiste SRE jobs in Montréal-Ouest, Quebec, Canada
Similar Jobs
Spécialiste SRE (Site Reliability Engineering)
About the role
Nous sommes à la recherche d'un(e) Spécialiste SRE (Site Reliability Engineering) pour contribuer à la fiabilité, à la disponibilité et à la performance de plateformes critiques dans un environnement technologique moderne. Vous jouerez un rôle clé dans l'automatisation des opérations, l'amélioration de l'observabilité des systèmes et l'évolution des pratiques DevOps. En collaboration avec les équipes de développement, d'architecture et d'exploitation, vous contribuerez à concevoir des solutions robustes, sécuritaires et hautement disponibles tout en favorisant l'amélioration continue des plateformes. Ce rôle s'adresse à une personne passionnée par l'automatisation, les infrastructures infonuagiques et les environnements distribués, qui souhaite avoir un impact concret sur la stabilité et la performance des systèmes.
Responsabilités principalesFiabilité et exploitation
Assurer la disponibilité, la stabilité et la résilience des plateformes critiques en production; Participer à l'amélioration continue de la performance, de la sécurité et de la fiabilité des environnements; Identifier les risques techniques et proposer des solutions durables pour assurer la pérennité des plateformes; Contribuer à la gestion des incidents, à l'analyse des causes fondamentales et à la mise en place d'actions préventives.
Automatisation et DevOps
Concevoir, développer et maintenir des solutions d'automatisation pour les infrastructures et les processus de déploiement; Développer et optimiser les pipelines d'intégration et de déploiement continus (CI/CD); Mettre en œuvre les pratiques d'infrastructure as Code (IaC) afin d'automatiser le provisionnement et la gestion des environnements; Automatiser les tests, les contrôles de qualité et les processus d'exploitation.
Observabilité et amélioration continue
Concevoir et faire évoluer les solutions d'observabilité, incluant les journaux, les métriques, les tableaux de bord et les alertes; Définir et suivre les indicateurs de disponibilité, de performance et de fiabilité (SLI, SLO, SLA); Collaborer avec les équipes de développement afin d'intégrer les meilleures pratiques SRE dès la conception des solutions; Participer à la planification technique, documenter les standards et promouvoir les bonnes pratiques d'exploitation.
Profil recherché
Détenir un baccalauréat en informatique, en génie logiciel ou dans un domaine connexe, ou posséder une expérience équivalente; Cumuler au moins cinq années d'expérience pertinente en SRE, DevOps, administration de systèmes ou exploitation de plateformes; Démontrer une solide expérience en automatisation, intégration et déploiement continus (CI/CD); Maîtriser les principes d'Infrastructure as Code (IaC); Posséder une excellente compréhension des environnements infonuagiques, distribués et hautement disponibles; Être reconnu(e) pour son esprit d'analyse, son autonomie et sa capacité à résoudre des problèmes complexes; Avoir d'excellentes aptitudes en collaboration et en communication avec des équipes multidisciplinaires.
Compétences techniques recherchées
Site Reliability Engineering (SRE) Infrastructure as Code (Terraform, Ansible) Docker Kubernetes Git CI/CD Java ou administration de systèmes Observabilité Splunk Datadog SonarQube AWS Atouts Expérience dans des environnements critiques à haute disponibilité; Connaissance des architectures distribuées et des microservices; Expérience en amélioration de la performance et de la résilience des plateformes; Certification AWS ; Connaissance des bonnes pratiques DevSecOps et des environnements infonuagiques. Pourquoi vous joindre à l'équipe? Contribuer à la fiabilité de plateformes critiques à grande échelle; Évoluer dans un environnement Agile misant sur l'automatisation et l'innovation; Travailler avec des technologies modernes en infonuagique, DevOps et observabilité; Collaborer avec des équipes multidisciplinaires sur des projets technologiques stratégiques; Développer votre expertise dans un environnement favorisant l'amélioration continue et l'évolution professionnelle.
Not the right fit? Search for Spécialiste SRE jobs in Montréal-Ouest, Quebec, Canada