Nagios je stale king of monitoring. Pro naše potřeby — heterogenní prostredi s desítkami serveru, databazi a aplikačních serveru — je Nagios s jeho ekosystémem pluginů neprekotany. Ale monitorovat Java aplikacni server není jen kontrola, zda port odpovídá.
JMX monitoring¶
Plugin check_jmx se připojuje pres JMX port (SSL) ke GlassFish a cte metriky: heap memory, thread count, loaded classes, GC time, connection pool utilization, session count.
Custom pluginy pro business metriky¶
Perl pluginy kontrolují počet zpracovaných objednávek za hodinu, měří response time SOAP endpointu, kontrolují stari posledního zaznamu v audit logu. Business monitoring je to, co klient skutecne ocení.
Alerting a eskalace¶
Tristupnovy model: WARNING = email na tým. CRITICAL = SMS na on-call admina (reakce 30 min). CRITICAL déle nez 30 min = eskalace na senior admina. On-call rotace tydenne — včetně vývojářů, aby byli motivovaní psát stabilní kod.
SLA reporting¶
Měsíční report z Nagios availability dat. Konzistentně plníme 99.5 procent uptime díky monitoringu a rychle reakci.
Pouceni¶
Monitoring není nice-to-have, je to must-have. Investice se vrátí pri prvním incidentu, který zachytíte dřív nez klient.
Potřebujete pomoc s implementací?
Naši experti vám pomohou s návrhem, implementací i provozem. Od architektury po produkci.
Kontaktujte nás