Le SRE senior sera chargé de garantir la fiabilité, les performances et l'évolutivité des systèmes critiques. Vous mettrez à profit votre expertise en génie logiciel et en opérations pour améliorer l'observabilité, automatiser les opérations et réduire les temps d'arrêt.
Mettre en place et assurer la maintenance de systèmes de surveillance, d'alerte et d'observabilité
Améliorer la fiabilité du système grâce à l'automatisation et à l'optimisation des performances
Coordonner la gestion des incidents, l'analyse des causes profondes et les analyses rétrospectives
Collaborer avec les équipes chargées de la plateforme, de l'automatisation et de la sécurité
Développer des outils visant à réduire les tâches opérationnelles manuelles
Veiller à ce que les SLA, les SLO et les SLI soient définis et respectés
Solide expérience en SRE ou DevOps dans des environnements cloud
Expérience avec les outils de surveillance (Prometheus, Grafana, Azure Monitor, etc.)
Maîtrise des langages de script et de l'automatisation
Une solide maîtrise des systèmes distribués et de l'ingénierie de la fiabilité
néerlandophone
Hybride : 1 à 2 jours par semaine à Amstelveen