Développeur; se) en fiabilité de site Engineering Montreal
Listed on 2026-09-30
-
Software Development
DevOps, Cloud Engineer - Software, Software Engineer
Location: Montreal
Nous recherchons un
· e développeur(se) en fiabilité des sites (SRE) pour contribuer à améliorer la fiabilité, l’observabilité et l’autonomie des développeurs chez MaintainX, alors que nous faisons évoluer notre plateforme.
Dans ce rôle, vous collaborerez étroitement avec les équipes de développement produit et plateforme afin d’améliorer la stabilité, la résilience et la préparation opérationnelle de nos services. Vous travaillerez aux côtés des équipes pour concevoir la fiabilité dès le départ, définir clairement les responsabilités ainsi que les standards, et développer des outils partagés permettant aux équipes d’exploiter leurs services en toute confiance.
Vous contribuerez également à des initiatives à l’échelle de l’entreprise qui définissent l’approche de MaintainX en matière d’ingénierie de la fiabilité, notamment les standards d’observabilité, les pratiques de gestion des incidents et les indicateurs de santé des services, en aidant l’organisation à adopter des pratiques éprouvées de l’industrie à grande échelle.
Ce poste convient particulièrement à un
· e développeur(se) qui aime travailler de manière transversale, influencer l’orientation technique grâce à de solides pratiques de développement, et transformer les principes de fiabilité en systèmes concrets, évolutifs et pérennes.
- Participer à l’évaluation du niveau de maturité des services et formuler des recommandations aux équipes de développement
- Collaborer avec les équipes de développement afin de mettre en place les meilleures pratiques en matière d’observabilité
- Permettre aux équipes de développement de gagner en autonomie dans le déploiement, le soutien et l’exploitation de leurs services et de leur infrastructure
- Encadrer et accompagner les développeurs sur les pratiques de fiabilité, en mettant l’accent sur leur autonomie
- Travailler en étroite collaboration avec les autres équipes de la division plateforme afin de favoriser l’adoption des pratiques auprès des équipes de développement
- Excellente compréhension des pratiques d’observabilité dans des environnements de systèmes distribués, ainsi que de leur influence sur la conception des systèmes et le fonctionnement des équipes
- Expérience pratique des concepts SRE (SLO, budgets d’erreur, gestion des incidents)
- De 3 à 5 ans et plus d’expérience en développement logiciel, SRE, Dev Ops ou en développement de production, incluant l’exploitation de systèmes en production
- Maîtrise des plateformes infonuagiques natives et des concepts et outils d’infrastructure en tant que code
- Connaissance pratique d’au moins un langage de programmation (TypeScript / Node.js constitue un atout)
- Excellentes aptitudes en communication et en collaboration, tant avec des équipes techniques que non techniques
- Capacité à vulgariser des concepts complexes liés à la fiabilité et à les transformer en recommandations concrètes
- Vous aimez permettre aux équipes de réussir de façon autonome et mesurez votre succès par la diminution de leur dépendance à votre égard
- Un niveau avancé de l'anglais, à l'oral et à l'écrit, est requis puisque la personne devra diriger des gestionnaires d'ingénierie de plateforme répartis sur plusieurs équipes, présenter les priorités techniques à des parties prenantes exécutives, et s'aligner quotidiennement avec des leaders d'ingénierie situés à l'extérieur du Québec.
(If this job is in fact in your jurisdiction, then you may be using a Proxy or VPN to access this site, and to progress further, you should change your connectivity to another mobile device or PC).