Talent.com
TobogganLabs
Ingénieur·e en fiabilité des sites - Site Reliability EngineerTobogganLabs • Montreal (administrative region), Quebec, CA
Ingénieur·e en fiabilité des sites - Site Reliability Engineer

Ingénieur·e en fiabilité des sites - Site Reliability Engineer

TobogganLabs • Montreal (administrative region), Quebec, CA
Il y a plus de 30 jours
Type de contrat
  • Temps plein
Description de poste

Ingénieur·e en fiabilité des sites - Site Reliability Engineer

Montréal, Quebec, Canada

La version anglaise suivra – English version will follow

Ingénieur·e en fiabilité des sites

Toboggan Labs est une firme-conseil boutique qui œuvre à l'intersection de l'IA et de la santé. Nous résolvons des problèmes humains complexes en appliquant des technologies de pointe combinées à une solide compréhension du domaine.

À propos du poste

Nous sommes à la recherche d'un·e ingénieur·e en fiabilité des sites (SRE) pour aider nos clients à concevoir et exploiter des systèmes de production fiables, observables et sécurisés.

Dans ce rôle, vous travaillerez aux côtés des équipes d'ingénierie et d'exploitation de nos clients pour améliorer la fiabilité des systèmes, réduire les tâches manuelles répétitives et bâtir les fondations opérationnelles — pipelines de déploiement, surveillance, gestion des incidents, infrastructure — qui maintiennent les systèmes en production en bonne santé.

Veuillez noter que, bien que nous soyons spécialisés dans le secteur de la santé et les industries réglementées, tous nos projets ne relèvent pas de ces domaines. Vous pourriez donc être amené·e à travailler sur des projets variés dans différents secteurs, selon les besoins.

Vos responsabilités quotidiennes

  • Ingénierie d'infrastructure et de sécurité — Concevoir et maintenir des infrastructures infonuagiques résilientes et sécurisées à l'aide d'outils d'infrastructure-as-code; implanter des contrôles de sécurité, des standards de durcissement et des guardrails de conformité dans les environnements clients.
  • Observabilité et fiabilité — Concevoir et implanter des systèmes de surveillance, d'alertes et de journalisation; piloter les processus de réponse aux incidents et de post-mortems; définir et suivre les SLO/SLI.
  • Automatisation et opérations de plateforme — Automatiser les pipelines de déploiement, le provisionnement d'infrastructure et les runbooks opérationnels pour réduire les tâches manuelles et améliorer la résilience des systèmes.
  • Sur certains mandats, leadership technique — Piloter le volet fiabilité et infrastructure, guider les équipes clients sur les pratiques SRE et contribuer aux décisions architecturales.
  • Soutien à l'équipe — Partager votre expertise en fiabilité et opérations, contribuer aux outils et à la documentation internes, mentorer des collègues et participer à la communauté Toboggan.

Nous recherchons des personnes ayant un solide historique en infrastructure infonuagique, DevOps et ingénierie de la fiabilité, qui abordent tout ce qu'elles construisent avec un souci de la sécurité. La majorité de nos clients utilisent AWS, Terraform, GitHub Actions ou des outils CI/CD similaires. Vous devez être à l'aise pour travailler à la frontière entre la fiabilité, la sécurité et les opérations TI.

Quand nous parlons de fiabilité des systèmes, nous cherchons quelqu'un qui traite la fiabilité comme une fonctionnalité à part entière, et non comme une réflexion après-coup — quelqu'un qui écrit du code pour éliminer les tâches répétitives, pense en termes de systèmes et construit des infrastructures aussi sécurisées qu'observables.

Nous vous encourageons à postuler si vous :

  • Avez 5 ans ou plus d'expérience en infrastructure, DevOps ou ingénierie de la fiabilité des sites.
  • Avez une expérience pratique avec des infrastructures AWS ou Azure et des outils d'infrastructure-as-code (Terraform, CloudFormation ou équivalents).
  • Avez une solide expérience avec les pipelines CI/CD (GitHub Actions, ArgoCD, Jenkins ou équivalents) et l'automatisation des déploiements.
  • Avez de l'expérience avec des outils d'observabilité (Prometheus, Grafana, Datadog, CloudWatch ou équivalents) et les processus de gestion des incidents.
  • Êtes familier·ère avec les bonnes pratiques de sécurité pour l'infrastructure infonuagique, incluant la sécurité réseau, l'IAM, le chiffrement et la gestion des vulnérabilités.
  • Possédez d'excellentes compétences en communication et êtes capable d'expliquer des concepts d'infrastructure et de fiabilité à des parties prenantes variées.
  • Êtes adaptable, autonome et à l'aise dans des environnements clients dynamiques.
  • Savez expliquer les compromis entre fiabilité et sécurité et les relier aux besoins d'affaires.

Atouts supplémentaires

  • Expérience dans des rôles orientés client (consultation, ingénierie d'implantation, services-conseils).
  • Expérience dans le secteur de la santé ou d'autres industries fortement réglementées.
  • Expérience en développement logiciel au-delà du simple scripting (développement de fonctionnalités, d'API ou d'applications).
  • Expérience avec l'orchestration de conteneurs (Kubernetes, ECS) et les outils de sécurité cloud-native.
  • Expérience en automatisation d'infrastructure à l'aide de scripts (Python, Bash) ou d'outils de workflow.
  • Détention de certifications pertinentes (AWS DevOps Professional, AWS Solutions Architect, CKA ou équivalentes).

Ce que nous offrons

  • Budget pour le bureau à domicile et la technologie.
  • Budget annuel de développement professionnel.
  • REER avec contribution de l'employeur après 1 an.
  • Dès le premier jour : Assurance santé et dentaire payée à 100 % par l'employeur, incluant un montant annuel pour les soins complémentaires (acupuncture, ostéopathie, massothérapie, naturopathie, psychologie, etc.).
  • Assurance vie et assurance invalidité de courte et de longue durée.
  • Complément de congé parental (8 semaines), disponible pour les employés ayant plus d'un an d'ancienneté, quel que soit le chemin vers la parentalité.

Bonus points if you:

  • Mettre en place une alerte emploi
#J-18808-Ljbffr
Créer une alerte emploi pour cette recherche

Ingénieur·e en fiabilité des sites - Site Reliability Engineer • Montreal (administrative region), Quebec, CA

Offres similaires

Site Reliability Engineer

ApTaskMontréal, Quebec, Canada
Temps plein

Direct message the job poster from ApTask Looking for an intermediate between 2 to 5 years' experience.The Application Infrastructure (Al) department is seeking a Site Reliability Engineer (SRE) to... Voir plus

 • Offre sponsorisée

Responsable de l'ingénierie des systèmes d'exploitation (OSE)

L3Harris TechnologiesMontreal (administrative region), QC, CA
Temps plein

Responsable de l'ingénierie des systèmes d'exploitation (OSE).Échelle salariale : $100,500 - $150,500 CDN par an.Stratégie technique et planification des tests.Élaborer des plans de tests complets ... Voir plus

 • Offre sponsorisée

Ingénieure ou Ingénieur intermédiaire en réhabilitation sans-tranchée des réseaux souterrains

CIMA+Terrebonne, Lanaudière, CA
Temps plein

Ingénieure ou Ingénieur intermédiaire en réhabilitation sans-tranchée des réseaux souterrains.Bienvenue là où l’humain est au cœur de tout.Bienvenue aux gens qui ont une vision d’avenir inspirante ... Voir plus

 • Offre sponsorisée

Senior Site Reliability Engineer Focused on Kubernetes Infrastructure

Chainlink LabsMontreal (administrative region), QC, CA
Temps plein

Elevate decentralized architecture as a Senior Site Reliability Engineer.Spearhead Kubernetes-based infrastructure for decentralized applications, driving scalability, security, and operational eff... Voir plus

 • Offre sponsorisée

Ingénieur/Spécialiste en maintenance & fiabilité - Maintenance & Reliability Engineer / Specialist

GrifolsMontreal (administrative region), QC, CA
Temps plein

Ingénieur/Spécialiste en maintenance et fiabilité.Gestionnaire Principal de la Maintenance de production.Dans le cadre de nos activités de fabrication de produits dérivés du plasma stériles, l'ingé... Voir plus

 • Offre sponsorisée

Senior Site Reliability Engineer (Remote-First)

VySystemsMontreal (administrative region), QC, CA
Télétravail
Temps plein

A leading technology company is seeking a Senior Site Reliability Engineer with robust Kubernetes knowledge to work remotely.Ideal candidates have over 6 years of experience in IT disciplines, prof... Voir plus

 • Offre sponsorisée

Ingénieur(e) en réhabilitation de bâtiments

RJC EngineersMontreal (administrative region), QC, CA
Temps plein

Concepteur(trice) en science du bâtiment et restauration structurale.L'équipe de RJC Ingénierie à Montréal s'agrandit à nouveau.Il s'agit d'une opportunité exceptionnelle de se joindre à une équipe... Voir plus

 • Offre sponsorisée

Ingénieur SLI Sénior - Optimisation & Maintenabilité

LGMMontreal, Montreal (administrative region), CA
Temps plein

Une entreprise spécialisée en ingénierie recherche un Ingénieur Soutien Logistique Intégré (SLI) Sénior à Montréal.Ce rôle exige une solide expérience en maintenance et une capacité à collaborer av... Voir plus

 • Offre sponsorisée

Ingénieur(e) en stress Statiques / Stress Engineer - Static

Capgemini EngineeringMontreal (administrative region), QC, CA
Temps plein

At Capgemini Engineering, the world leader in engineering services, we bring together a global team of engineers, scientists, and architects to help the world’s most innovative companies unleash th... Voir plus

 • Offre sponsorisée

Ingénieur(e) senior - systèmes avioniques

SOGECLAIRMontreal (administrative region), QC, CA
Temps plein

Be responsible and support the timely integration of systems, such as AFCS, Communication (VHF, HF, SATCOM, Datalink), Navigation (ADF, VOR, ILS, DME, TCAS, Transponder, IRS, GPS, FMS, Weather Rada... Voir plus

 • Offre sponsorisée

Senior Site Reliability Engineer

ThinkificMontreal (administrative region), QC, CA
Temps plein

Senior Site Reliability Engineer.Senior Site Reliability Engineer.Are you an experienced Site Reliability Engineer looking for a new challenge?.Senior Site Reliability Engineer.Senior Site Reliabil... Voir plus

 • Offre sponsorisée

Site Reliability Engineer

BasetenMontréal, Canada
Temps plein

About BasetenBaseten powers mission‐critical inference for the world's most dynamic AI companies, like Cursor, Notion, OpenEvidence, Abridge, Clay, Gamma and Writer.By uniting applied AI resear... Voir plus

 • Offre sponsorisée

Ingénieur de projet Senior - Site de Royalmount

Pharmasciencemontreal (administrative region), qc, Canada
Temps plein

L’Ingénieur de projet senior en ingénierie est un poste basé au site de.Travail de bureau et en usine; Occasionnellement sur des chantiers de construction.Il est responsable de la planification, de... Voir plus

 • Offre sponsorisée

Ingénieur·e en fiabilité des sites - Site Reliability Engineer

TobogganLabsMontreal (administrative region), QC, CA
Temps plein

Ingénieur·e en fiabilité des sites - Site Reliability Engineer.La version anglaise suivra – English version will follow.Ingénieur·e en fiabilité des sites.Toboggan Labs est une firme-conseil boutiq... Voir plus

 • Offre sponsorisée

Site Reliability Engineer

TELUS DigitalMontreal (administrative region), QC, CA
Temps plein

Welcome to TELUS Digital — where innovation drives impact at a global scale.As an award-winning digital product consultancy and the digital division of TELUS, one of Canada’s largest telecommunicat... Voir plus

 • Offre sponsorisée

Senior Site Reliability Engineer- Remote

ClickHouseMontreal (administrative region), QC, CA
Télétravail
Temps plein

Senior Site Reliability Engineer- Remote.Recognized on the 2025 Forbes Cloud 100 list, ClickHouse is one of the most innovative and fast-growing private cloud companies.With more than 3,000 custome... Voir plus

 • Offre sponsorisée

Senior Site Reliability Engineer

SecurityScorecardmontreal (administrative region), qc, Canada
Temps plein

SecurityScorecard is the global leader in cybersecurity ratings, with over 12 million companies continuously rated, operating in 64 countries.Founded in 2013 by security and risk experts Dr.Alex Ya... Voir plus

 • Offre sponsorisée

Ingénieur de projets – Optimisation des procédés (secteur laitier)

AgropurMontreal (administrative region), QC, CA
Permanent

Nous croyons que les meilleurs résultats viennent de la collaboration, du partage de points de vue et du travail en équipe.Agropur est à la recherche d’un Ingénieur de projets – Optimisation des pr... Voir plus

 • Offre sponsorisée

Ingénieur en Réhabilitation à Montréal

WSP in CanadaLaval (administrative region), QC, CA
Temps plein

Intégrez WSP à Montréal en tant qu'ingénieur en réhabilitation, en développant des stratégies innovantes pour résoudre des problèmes environnementaux.Cette position intermédiaire nécessite un diplô... Voir plus

 • Offre sponsorisée

Affinerie CCR - Ingénieur(e) en intégrité des actifs - Structures et infrastructures

GlencoreMontreal (administrative region), QC, CA
Temps plein

Ingénieur(e) en intégrité des actifs - Structures et infrastructures.Glencore est l'une des plus grandes entreprises de ressources naturelles diversifiées au monde.Elle est aussi une importante ent... Voir plus