Back to all jobs

Spécialiste sénior de la Fiabilité des sites (SRE)

Technology
AlayaCare, logiciel de soins à domicileGreater Montreal Area, QC, CAPosted 2026-07-17

Description

À propos d'AlayaCare

Chez AlayaCare, nous sommes plus qu'une entreprise SaaS en forte croissance : nous sommes une équipe de passionné(e)s qui transforment les soins à domicile. Notre plateforme infonuagique permet aux fournisseurs de soins du monde entier d'offrir de meilleurs résultats à leurs client(e)s.

Avec plus de 550 employé(e)s au Canada, aux États-Unis, en Australie et au Brésil, nous sommes uni(e)s par une mission commune et une culture forte de transparence, de croissance et de connexion humaine. Que vous soyez en début de carrière ou un(e) expert(e) chevronné(e), AlayaCare vous offre l'opportunité de faire grandir votre impact, vos compétences et votre carrière.

À propos du rôle

Nous recherchons un(e) Spécialiste de la Fiabilité des sites sénior pour rejoindre notre équipe SRE. Vous serez responsable de la mise à l'échelle de l'infrastructure cloud AWS, de l'évolution des pipelines de déploiement Kubernetes, de l'amélioration de la surveillance, des alertes et de la résilience, ainsi que du développement d'outils permettant aux équipes produit de livrer de manière sûre et efficace. Pour les produits acquis basés sur Azure, l'accent est mis sur la surveillance, le triage des alertes et la gestion des incidents guidée par des dossiers d'exploitation (« runbooks »), plutôt que sur la conception de plateformes à partir de zéro.

Ce rôle est responsable des services de plateforme partagés à travers les régions cloud, incluant les bases de données, la messagerie, la journalisation, la recherche et le provisionnement des locataires. Le/la Spécialiste de la Fiabilité des sites sénior est appelé(e) à diriger des initiatives d'infrastructure majeures et des projets de preuve de concept, à contribuer à la planification technique et à la priorisation, et à collaborer avec les équipes Produit afin de réduire les incidents opérationnels.

L'équipe SRE développe et opère également des outils basés sur l'IA pour optimiser les des dossiers d'exploitation (« runbooks »), accélérer la réponse aux incidents et générer des insights opérationnels à partir de la télémétrie de la plateforme, dans le but d'améliorer la fiabilité et de réduire les efforts manuels.

Développement, automatisation et outillage

  • Concevoir, construire et maintenir l'infrastructure et les services de plateforme, notamment les outils Kubernetes et d'observabilité.
  • Mettre en œuvre l'infrastructure en tant que code, la gestion de configuration et les tests automatisés pour garantir des environnements fiables et reproductibles.
  • Contribuer aux révisions de code et de configuration pour améliorer la scalabilité, la maintenabilité et la réutilisabilité.

Fiabilité et opérations

  • Surveiller les systèmes en production, résoudre les problèmes et améliorer la journalisation, la surveillance, les alertes et les des dossiers d'exploitation (« runbooks »).
  • Participer aux rotations d'astreinte et de support, à la gestion des incidents et aux bilans post-incidents pour améliorer la fiabilité à long terme.

Exigences et collaboration

  • Collaborer avec les équipes Produit, Ingénierie et Développement pour traduire les exigences en solutions d'infrastructure fiables et opérables.
  • Identifier les risques liés à l'opérabilité, la sécurité, la performance et les coûts, et recommander des compromis pragmatiques.

Amélioration continue

  • Contribuer à la qualité opérationnelle via les des dossiers d'exploitation (« runbooks »), le renforcement de la sécurité, l'optimisation des performances et l'amélioration des processus.
  • Se tenir à jour sur les pratiques SRE émergentes, notamment les opérations assistées par IA et les patterns modernes de plateforme AWS.

Ce que vous apportez à l'équipe

  • Baccalauréat ou diplôme supérieur en informatique, génie informatique ou domaine connexe, avec une expérience pratique démontrée.
  • 5 ans ou plus d'expérience pratique.
  • Solide expérience pratique d'AWS dans un environnement multi-comptes et multi-régions : EKS, AWS Organizations, IAM et KMS.
  • Maîtrise avancée de Terraform et des flux de travail Infrastructure as Code, incluant Atlantis/GitOps, la gestion des états, et les mises à niveau de modules/fournisseurs.
  • Expérience pratique de l'exécution de charges de travail sur Docker et Kubernetes en production, incluant les patterns d'entrée Gateway API et la gestion du cycle de vie des clusters (mises à niveau, extensions, provisionnement des nœuds).
  • Solide expérience en administration de systèmes Linux et en résolution de problèmes en production.
  • Maîtrise d'au moins un langage de développement ou de script tel que Python, Go ou Bash.
  • Expérience avec une plateforme d'observabilité (ex. : New Relic, OpenSearch, CloudWatch, OpenTelemetry) et les alertes orientées événements (ex. : EventBridge, SNS, PagerDuty).
  • Connaissance des fondamentaux de la sécurité des systèmes et des réseaux, incluant WAF, IAM à moindre privilège, gestion des secrets et reprise après sinistre.
  • Expérience dans la gestion des incidents (astreinte, triage, remédiation, bilan post-incident) et la rédaction de des dossiers d'exploitation (« runbooks ») opérationnels.
  • Expérience pratique de l'exploitation d'Aurora MySQL et PostgreSQL en production, incluant les migrations, l'optimisation des performances et la sauvegarde/restauration.
  • Excellentes aptitudes à la communication et à la collaboration, avec la capacité de travailler efficacement avec des équipes techniques et non techniques dans un environnement distribué.
  • Une expérience en optimisation des coûts cloud (« rightsizing », capacité réservée et étiquetage des coûts) est un atout.
  • Une expérience avec Flux/ArgoCD, Karpenter ou l'infrastructure GPU Ray/Anyscale est un atout.
  • Une expérience dans la surveillance de systèmes en production sur Azure est un atout.
  • Certifications cloud ou Kubernetes sont un atout.
  • Le bilinguisme français-anglais est un atout.

Pourquoi rejoindre AlayaCare?

Donnez un sens à votre travail

Chez AlayaCare, vous aiderez à concevoir une technologie qui donne des moyens aux fournisseurs de soins et qui améliore les résultats pour les patient(e)s et leurs familles. Chaque ligne de code et chaque interaction avec un(e) client(e) contribue à rendre les soins plus connectés, accessibles et humains.

Évoluer dans une culture de confiance

Nous croyons en la transparence, à la rétroaction et au fait d'assumer les bonnes intentions. Ici, vous vous sentirez en sécurité pour partager vos idées et vos objectifs de carrière. Vous serez soutenu(e) pour les atteindre par l'entremise de mentorat, de la mobilité professionnelle et de notre philosophie de promotion à l'interne.

Un équilibre qui vous convient

Nous accordons une grande importance à la flexibilité et au bien-être. Des « Vendredis bien-être » au congé pour le bénévolat en passant par des vacances flexibles, nous nous assurons que vous avez de l'espace pour vous ressourcer, contribuer à votre communauté et vivre votre meilleure vie.

Des avantages qui comptent

  • Des actions dans une entreprise en croissance et bien financée.
  • Des avantages sociaux complets, la télémédecine et des comptes de dépenses de style de vie.
  • Un complément de congé parental et des programmes de soutien à la famille.
  • Conception inclusive

Nous célébrons les perspectives diverses et favorisons l'appartenance par le biais de nos initiatives DEIB (Diversité, Équité, Inclusion et Appartenance). Les événements menés par les employé(e)s, les sommets et les activités sociales, en personne comme virtuelles, créent des liens significatifs entre nos équipes mondiales.

Lieu de travail et modèle de travail

Ce poste est situé dans la grande région de Montréal. Chez AlayaCare, notre modèle hybride comprend des journées de collaboration au bureau, et les membres de l'équipe sont attendu(e)s à s'y présenter ces jours-là pour favoriser les liens, l'innovation et le travail d'équipe.

Prêt(e) à vous joindre à nous?

Postulez dès aujourd'hui et faites partie d'une entreprise qui fait une réelle différence dans l'avenir des soins à domicile et communautaires. Ce poste n'est pas pour vous? Partagez cette offre avec une personne qui pourrait y être un excellent atout.

AlayaCare utilise des outils d'IA durant son processus d'embauche pour soutenir une prise de décision juste, cohérente et objective. Certaines étapes de sélection initiales peuvent être automatisées pour aider à identifier les candidat(e)s qualifié(e)s. Si votre candidature est refusée automatiquement, vous pouvez demander une révision humaine.

Nous nous engageons à créer un milieu de travail où chacun et chacune se sent chez soi. Si vous avez besoin d'un accommodement durant le processus de candidature, veuillez contacter talentacquisitionteam@alayacare.com.

This posting was aggregated from indeed. Groupe Sentinella is not the employer; applying takes you to the original site. The full text belongs to the original poster.

Want us in your corner?

Join the Sentinella talent bench. We'll reach out when a mandate matches your profile — including roles like this one.

Join the talent bench