Notre défi:
Nous sommes à la recherche d’un(e) ingénieur(e) en fiabilité des sites (Site Reliability Engineer – SRE) compétent(e) pour concevoir, exploiter et améliorer des systèmes de production hautement disponibles, évolutifs et fiables. La personne idéale possédera une solide expérience en administration Linux, création de scripts Python, bases de données, outils infonuagiques et DevOps, surveillance, automatisation et soutien de production.
Informations Complémentaires*
Le salaire de base pour ce poste variera en fonction de la géographie et d'autres facteurs. Conformément à la loi, le salaire de base pour ce poste s'il est pourvu à Montreal est de 80,000 $ CAD à 90,000 $/an et avantages sociaux (voir ci-dessous).
Responsabilités
- Diagnostiquer et résoudre les problèmes dans l’ensemble de la pile technologique
- Collaborer avec les équipes d’ingénierie afin de concevoir, développer et soutenir des systèmes fiables
- Piloter l’automatisation des déploiements, des opérations et de la visibilité des services
- Repérer et atténuer les risques liés à la fiabilité et aux performances
- Participer aux examens de préparation opérationnelle et au soutien de production
- Collaborer avec des équipes internationales dans le cadre d’un modèle de soutien continu « follow-the-sun »
Exigences :
- Solides compétences en dépannage et en analyse des causes fondamentales
- Bonne expérience de Linux et de l’administration des systèmes
- Connaissance des langages de script Python, Bash, Perl ou Ruby
- Expérience avec des outils de surveillance et d’observabilité tels que Splunk, Grafana, AppDynamics ou Dynatrace
- Connaissance d’Ansible, GitHub ou d’autres outils d’automatisation et de gestion de la configuration
- Compréhension des systèmes distribués, des microservices, du cloud, de l’équilibrage de charge, des bases de données, de la mise en cache et des modes de défaillance
- Excellentes aptitudes en communication et capacité à collaborer avec des parties prenantes techniques et commerciales
Préféré, mais pas obligatoire :
- Expérience du soutien de plateformes d’entreprise à grande échelle
- Expérience en automatisation et en ingénierie de la fiabilité dans des environnements complexes
nous offrons :
- Une organisation multinationale avec 57 bureaux dans 22 pays et la possibilité de travailler à l'étranger.
- 15 jours (3 semaines) de congés annuels payés plus 10 jours de congés personnels et jours de maladie supplémentaires.
- Un régime d'assurance complet comprenant : assurance médicale, dentaire, visuelle, assurance vie et invalidité de longue durée.
- Une politique hybride flexible.
- REER avec contribution de l'employeur jusqu'à 4%.
- Une politique de certification d'enseignement supérieur.
- Udemy à la demande pour tous les employés de Synechron avec un accès gratuit à plus de 5000 cours sélectionnés.
- Possibilités de coaching avec des collègues expérimentés de nos Laboratoires d'Innovation Financière (FinLabs) et de nos Groupes d'Excellence (CoE).
- Projets de pointe dans les principales banques de premier rang, les institutions financières et les compagnies d'assurance du monde entier.
- Une culture de travail véritablement diversifiée, joyeuse et mondiale.
The Role
Responsibilities:
- Troubleshoot issues across the full technology stack
- Partner with engineering teams to design, build, and support reliable systems
- Drive automation for deployment, operations, and service visibility
- Identify and mitigate reliability and performance risks
- Participate in operational readiness reviews and production support
- Work with global teams in a follow-the-sun support model
Requirements:
- Strong troubleshooting and root cause analysis skills
- Good Linux/system administration experience
- Scripting knowledge in Python, Bash, Perl, or Ruby
- Experience with monitoring/observability tools like Splunk, Grafana, AppDynamics, or Dynatrace
- Exposure to Ansible, GitHub, or other automation/configuration tools
- Understanding of distributed systems, microservices, cloud, load balancing, databases, caching, and failure modes
- Strong communication skills with the ability to work with both technical and business stakeholders
Preferred, but not required:
- Experience supporting large-scale enterprise platforms
- Background in automation and reliability engineering within complex environments
We offer:
- A multinational organization with 57 offices in 22 countries and the possibility to work abroad.
- 15 days (3 weeks) of paid annual leave plus an additional 10 days of personal leave(floating days and sick days).
- A comprehensive insurance plan including medical, dental, vision, life insurance, and long-term disability.
- Flexible hybrid policy.
- RRSP with employer9s contribution up to 4%.
- A higher education certification policy.
- On-demand Udemy for Business for all Synechron employees with free access to more than 5000 curated courses.
- Coaching opportunities with experienced colleagues from our Financial Innovation Labs (FinLabs) and Center of Excellences (CoE) groups.
- Cutting edge projects at the world9s leading tier-one banks, financial institutions and insurance firms.
- A truly diverse, fun-loving and global work culture.