7 uur, 51 minuten ago

Operator Monitoring & Observability

1. Voorstelling van ETNIC

ETNIC (Entreprise pour les Technologies de l’Information et de la Communication) is de IT-operator van de Fédération Wallonie-Bruxelles. Als publiekrechtelijke instelling heeft ETNIC als opdracht het ontwerpen, ontwikkelen, onderhouden en laten evolueren van informatiesystemen en technologische infrastructuren ten dienste van de administraties en instellingen van de FWB.

Als centrale speler in de digitale transformatie van de Franstalige Belgische publieke sector, werkt ETNIC in uiteenlopende domeinen zoals:

  • Beheer van IT-infrastructuren (netwerken, beveiliging, datacenters, cloud),
  • Ontwikkeling van maatwerk businessapplicaties,
  • Begeleiding van digitale projecten (functionele analyse, UX/UI, projectmanagement),
  • Cybersecurity en gegevensbescherming,
  • Gebruikerssupport en opleiding.

Omwille van voortdurende innovatie, prestatie en publieke dienstverlening, werkt ETNIC regelmatig samen met externe partners om haar teams te versterken via IT-consultancymissies. Deze samenwerkingen gebeuren binnen een ethisch, professioneel kader en zijn gericht op kwaliteit en concrete impact van de geleverde oplossingen.

2. Missie

Zabbix – Beheer en exploitatie

  • Beheersen van de volledige Zabbix-omgeving: aanmaak en onderhoud van dashboards, netwerkmaps, triggers, items en templates
  • Configureren en aanpassen van alertdrempels (triggers) volgens zakelijke en technische behoeften, inclusief via gebruikersmacro’s en afhankelijke triggers om ruis te beperken
  • Creëren en onderhouden van herbruikbare monitoringtemplates (items, macro’s, LLD, low-level discovery)
  • Ontwerpen en onderhouden van items van het type Zabbix Agent, SNMP, JMX, HTTP Agent en External Checks afhankelijk van de use case
  • Ontwikkelen van gepersonaliseerde discovery scripts (LLD) voor automatische ontdekking van apparatuur en diensten
  • Diagnoses stellen van false positives, luidruchtige alerts en verzamelingsafwijkingen (proxy, pollers, timeouts) in samenwerking met technische teams onder supervisie van de verantwoordelijke
  • Dagelijks opvolgen van actieve alerts en hun kwalificatie (reëel incident vs ruis)
  • Configureren en onderhouden van integraties Zabbix ↔ ServiceNow (automatische incidentaanmaak) en Zabbix ↔ notificatietools
  • Beheren van de gedistribueerde Zabbix-architectuur (proxies, servers, high availability) en zorgen voor de prestaties
  • Deelnemen aan de evolutie van de monitoringarchitectuur (proxies, SNMP v2/v3-integraties, VMware API, NetFlow, enz.)
  • Uitvoeren van root cause analyses (RCA) op complexe, multilayer incidenten (netwerk, systeem, applicatie, opslag) op verzoek van technische teams
  • Beheersen van de Zabbix Services-module (Business Service Monitoring): opbouw van hiërarchische servicetrees, aggregatie van statussen (SLA/SLO) op basis van triggers, berekenen en opvolgen van beschikbaarheidspercentages per business service
  • Modelleren van end-to-end applicatieve services door technische componenten (hosts, triggers) te koppelen aan de betreffende business services, voor een gebruikers-/businessgerichte visie in plaats van louter infrastructuur
  • Configureren van problem tags en propagatieregels voor een nauwkeurige mapping tussen technische incidenten en impact op de diensten
  • Gebruiken van de SLA-rapporten gegenereerd door de Services-module voor maandelijkse rapportering en beschikbaarheidsreviews

Oh Dear – Website monitoring

  • Opzetten en onderhouden van de technische monitoring van websites op Oh Dear (beschikbaarheid, SSL-certificaten, prestaties, uptime, broken links, mixed content)
  • Configureren van alerts (email, webhooks, integraties van derden) en dagelijks controleren van de status van gemonitorde sites
  • Gebruiken van de REST API van Oh Dear voor data-extractie en integratie met reportingtools (Power BI, is een plus)
  • Opvolgen van gedetecteerde incidenten en deze rapporteren aan de betrokken teams, met impactanalyse

ServiceNow – Ticket- en incidentbeheer

  • Dagelijks controleren van incidenten aangemaakt in ServiceNow gelinkt aan monitoring en zorgen voor technische kwalificatie
  • Behandelen van alle aanvragen van IT-teams die via ons request catalog in ServiceNow en per email binnenkomen
  • Kwalificeren, prioriteren (volgens impact/urgentie) en behandelen van monitoring-gerelateerde aanvragen ontvangen via ServiceNow of per email
  • Bijdragen aan de betrouwbaarheid van de CMDB in relatie tot discoveryprocessen (VMware, netwerk) en het oplossen van identificatieconflicten
  • Zorgen voor een nauwkeurige opvolging tot aan de afsluiting van tickets, met documentatie van uitgevoerde acties

Observability

  • Deelnemen aan de continue verbetering van de observability van IT-diensten door het combineren van informatie uit monitoring, logs, events en supervisietools
  • Bijdragen aan de definitie en evolutie van gezondheids-, beschikbaarheids- en prestatie-indicatoren van business services
  • Correlëren van alerts, metrics, events en technische data om de snelle identificatie van incidentoorzaken te vergemakkelijken
  • Bijdragen aan de reductie van operationele ruis door verbetering van supervisieregels, alertdrempels en correlatiemechanismen
  • Samenwerken met de teams voor infrastructuur, netwerk, applicaties en integratie voor een end-to-end zichtbaarheid van kritieke diensten

Reporting

  • Identificeren van terugkerende incidenten en trends waargenomen via monitoringtools en operationele rapporten
  • Produceren van een maandelijkse monitoringrapport (beschikbaarheid, incidenten, trends, corrigerende acties, KPI/SLA) voor de begunstigden en het management, en op verzoek
  • Automatiseren van de rapportageproductie via scripts en API’s (Zabbix API, Oh Dear API, ServiceNow API) om de rapportering betrouwbaarder en sneller te maken
  • Opbouwen en onderhouden van management dashboards (Power BI, is een plus, of equivalent) voor het management en de technische teams indien nodig

Netwerk, API & Automatisatie

  • Diagnoses stellen van connectiviteits- en verzamelingsincidenten (SNMP, syslog, NetFlow, routing, ACL, VLAN, firewall)
  • Ontwikkelen en onderhouden van automatiseringsscripts (Python/Bash) voor monitoringchecks, LLD discovery scripts en dataverwerking (bv. export/verwerking CSV/Excel)
  • Consumptie en integratie van REST API’s tussen de verschillende tools in het ecosysteem (Zabbix, ServiceNow, Oh Dear, Power BI indien nodig)
  • Bijdragen aan applicatie-integratie tussen systemen (datastromen, JSON/XML-formaten) om de end-to-end monitoringketen betrouwbaar te maken
  • Documenteren van technische procedures en diagnoses (schema’s, operationele handleidingen)

DevOps-cultuur

  • Toepassen van CI/CD best practices voor versioning en deployment van monitoringconfiguraties (templates, dashboards)
  • Gebruik van Git voor versiebeheer van scripts en configuraties
  • Bijdragen aan automatisatie van de monitoringinfrastructuur via Infrastructure as Code-benaderingen (Ansible, Terraform)
  • Deelnemen aan de containerisatie van monitoringtools (Docker) indien van toepassing
  • Onderhouden van technische en operationele documentatie (wiki) evenals knowledge base (KB) artikelen
  • Zorgen voor kennisoverdracht naar support- en exploitatieteams

Als consultant bent u onderworpen aan dezelfde arbeidsvoorwaarden als ons intern personeel, namelijk een hybride werkvorm die aanwezigheid en telewerk combineert, met een verplichte minimum aanwezigheid van 50% op kantoor.

De missie is uitsluitend in het Frans.

3. Activiteiten

Instaan voor het beheer, de exploitatie en de evolutie van monitoring- en observabilitytools, onder toezicht van de verantwoordelijke Monitoring & CMDB. De activiteiten omvatten:

  • Beheren van Zabbix: aanmaak en onderhoud van dashboards, netwerkmaps, items, triggers en templates, automatiseren van discovery en optimaliseren van de monitoringarchitectuur
  • Modelleren en monitoren van end-to-end business- en applicatiediensten, met name via de Services-module van Zabbix, om de impact van incidenten te evalueren en de beschikbaarheid en SLA/SLO-afspraken op te volgen
  • Zorgen voor monitoring van websites via Oh Dear: beschikbaarheid, SSL-certificaten, prestaties en anomalieën
  • Kwalificeren en behandelen van alerts, incidenten en monitoringaanvragen in ServiceNow, opvolging tot afsluiting en bijdragen aan de betrouwbaarheid van de CMDB
  • Verbeteren van observability door het correleren van metrics, logs en events, het terugdringen van overbodige alerts en bijdragen aan de incidentdiagnose met technische teams
  • Ontwikkelen van integraties tussen tools en automatiseren van controles, datacollectie en reporting met behulp van REST API’s en Python/Bash-scripts
  • Produceren van beschikbaarheids- en performancerapporten, analyseren van terugkerende incidenten en onderhouden van management dashboards
  • Toepassen van Git-, CI/CD- en Infrastructure as Code-praktijken, onderhouden van technische documentatie en zorgen voor kennisoverdracht naar support- en exploitatieteams

Apply for this Job

This position was originally posted on Pro Unity.

It is publicly accessible, and we recommend applying directly through the Pro Unity website instead of going through third party recruiters.

Newsletter signup illustration