Monitoring moet niet alleen zeggen dát een server down is, maar vroeg signaleren dat disk, geheugen, database of certificaat richting een grens beweegt.
Stap voor stap
1. Monitor van buitenaf
Gebruik externe HTTP-checks zodat je ook netwerk- of volledige hostuitval ziet.
2. Monitor systeemmetrics
CPU, load, available RAM, swap, disk usage, inode usage en I/O latency zijn basis.
3. Monitor applicatie
Meet responstijd, foutcodes, queue-lengtes en databaseconnecties.
4. Stel bruikbare drempels in
Een diskwaarschuwing op 80% is nuttiger dan pas op 100%. Gebruik duurvoorwaarden zodat één korte piek niet direct alarm geeft.
5. Maak alerts actiegericht
Een melding moet host, metric, huidige waarde en eerste diagnosestap tonen.
6. Voorkom alert fatigue
Verwijder alerts waar nooit op wordt gehandeld en onderscheid warning van critical.
7. Test het alarmsysteem
Simuleer periodiek een storing of testalert en controleer of de juiste persoon hem ontvangt.
Voorbeeld alertregels
Voorbeeld:
Warning: disk > 80% gedurende 10 min
Critical: disk > 90% gedurende 5 min
HTTP: 3 opeenvolgende checks mislukt
Veelgemaakte fouten
- Honderden alerts zonder prioriteit.
- Alleen ping monitoren.
- Certificaatvervaldatum vergeten.
Korte controlelijst
- Externe uptime-check.
- Disk/inode monitoring.
- Database/applicatiemetrics.
- Alerts daadwerkelijk getest.
Conclusie
Server monitoring: problemen ontdekken voordat klanten ze merken wordt overzichtelijk wanneer je de wijzigingen gecontroleerd uitvoert, tussendoor test en back-ups paraat houdt. Heb je een productieomgeving waarop geen foutmarge mogelijk is, voer de wijziging dan eerst op staging uit of laat een beheerder meekijken.
