Une organisation informatique du secteur public fournit aux administrations publiques une infrastructure partagée et des services numériques. Ce poste consacré au monitoring de l’infrastructure s’articule autour de Zabbix, Elasticsearch et de l’intégration d’outils opérationnels. Il vise à relier les signaux techniques à la disponibilité des services et à leur impact.
La mission
Zabbix est la plateforme centrale de monitoring d’un environnement distribué composé de serveurs et de proxies, soumis à des exigences élevées de disponibilité. Vous gérez les dashboards, les cartes réseau, les templates réutilisables ainsi que la collecte via Zabbix Agent, SNMP, JMX, HTTP Agent et des contrôles externes. Vous configurez les macros, les dependent triggers et les règles de low-level discovery afin d’améliorer la collecte et de réduire les alertes parasites.
Vous modélisez également les services métier dans Zabbix Services en reliant les hosts et les triggers à des arborescences de services hiérarchiques. Vous configurez les problem tags et la propagation des états, puis exploitez les données de disponibilité et les rapports SLA/SLO pour mettre en évidence l’impact sur les services. Vous combinez les métriques, les logs et les événements pour faciliter le diagnostic des incidents et améliorer l’observabilité des composants d’infrastructure, de réseau et d’application.
Le poste comprend aussi le monitoring de sites web avec Oh Dear ou un outil équivalent, le traitement de tickets et de demandes liés au monitoring dans ServiceNow, ainsi que la maintenance des intégrations entre outils. Vous produisez des rapports mensuels sur la disponibilité et les performances, repérez les incidents récurrents et automatisez les contrôles, le traitement des données et la production de rapports au moyen d’API et de scripts.
Vos responsabilités
- Administrer les dashboards Zabbix, les cartes réseau, les items, les triggers, les templates, les macros et les règles de discovery.
- Modéliser les services métier de bout en bout et suivre leur disponibilité au regard des objectifs SLA/SLO.
- Analyser avec les équipes techniques les alertes parasites, les échecs de collecte et les incidents touchant plusieurs couches.
- Assurer le suivi de la disponibilité des sites web, des certificats SSL, des performances et des anomalies web avec Oh Dear ou un outil équivalent.
- Qualifier les incidents et les demandes de monitoring dans ServiceNow et documenter les actions jusqu’à leur clôture.
- Développer des intégrations REST API et des automatisations en Python ou Bash pour les contrôles, le traitement des données et les rapports.
- Analyser les incidents récurrents, rendre compte des tendances et tenir à jour les dashboards opérationnels et la documentation.
Votre profil
Compétences essentielles
- Expérience de niveau medior dans l’administration de Zabbix, notamment des dashboards, des maps, des triggers, des templates, des items, des macros et du LLD.
- Expérience de Zabbix Services, des arborescences de services, des problem tags, de la propagation des états et des rapports de disponibilité.
- Maîtrise d’Elasticsearch pour l’indexation, les requêtes et l’exploitation de données de logs et de métriques.
- Maîtrise des intégrations REST API, notamment de l’authentification, des Bearer tokens, de la pagination et des webhooks.
- Bonne compréhension des ESB et de l’intégration orientée services, notamment des API, des webhooks, de JSON/XML et des bus d’intégration.
- Solides connaissances en réseaux : SNMP v2/v3, syslog, NetFlow, TCP/IP, routing, VLANs et firewalls.
- Capacité à diagnostiquer les problèmes de connectivité et de collecte liés à ACL, ACI, SD-WAN et VPN.
- Maîtrise de Python et/ou Bash pour les contrôles de monitoring, les scripts de diagnostic, le LLD discovery et les tâches récurrentes.
- Maîtrise de ServiceNow pour la gestion des incidents et des tickets, ainsi qu’une bonne connaissance des concepts de CMDB.
Compétences souhaitées
- Expérience dans l’automatisation de workflows de monitoring, notamment l’auto-remediation, le reporting et les intégrations entre outils.
- Expérience d’Oh Dear ou connaissance d’un outil équivalent de monitoring de sites web.
- Connaissance de Git, de CI/CD et d’outils d’Infrastructure as Code tels qu’Ansible ou Terraform.
Langues
- Français (langue maternelle)
- Anglais (niveau non précisé)
- Néerlandais (B1)
Contexte de travail
- Travailler sous la responsabilité d’un responsable Monitoring et CMDB, en collaboration avec les équipes infrastructure, réseau, application et intégration.
- Le français est la langue de travail de la mission.
- Utiliser Git pour gérer les versions des scripts et des configurations de monitoring, et contribuer aux pratiques CI/CD et Infrastructure as Code. Docker peut être utilisé lorsque c’est pertinent.
- Tenir à jour les guides techniques et les articles de la base de connaissances, et transmettre les connaissances aux équipes de support et d’exploitation.
Et maintenant ?
Les personnes qui réussissent ici sont celles qui se sont reconnues dans cette description. Non pas parce qu'elles remplissent tous les critères, mais parce que la mission leur correspond.
Nous recrutons activement pour ce poste. Les candidatures sont examinées par notre équipe, et les profils qui correspondent reçoivent un appel pour discuter du poste en détail.
Postuler prend moins d'une minute. Votre email, votre CV. C'est tout ce dont nous avons besoin pour entamer la conversation.

