Cel mai des îmi spun clienții SMB: “Avem deja Zabbix / PRTG / un script care trimite mail când scade spațiul pe disc, e suficient.” Și până într-un punct chiar e. Funcționează, te anunță când ceva moare, costă puțin sau nimic. Apoi crești la 30-40 de servere, încep să apară micro-serviciile, container-ele, un cluster de Kubernetes mic, și deodată stack-ul vechi nu mai poate ține pasul.
L-am întâlnit la un client cu 25 de VM-uri pe Proxmox, 3 noduri Kubernetes (k3s pe bare metal pentru aplicațiile interne) și o stivă de containere Docker pe câteva host-uri standalone. PRTG-ul lor cu 100 sensori plătiți era depășit – nu putea face metrics per-container, alertele erau rigide, dashboard-urile fixe. Ne-au cerut “ceva care să crească cu noi fără să plătim 10k/an”.
Răspunsul a fost Prometheus + Grafana, cu Alertmanager în spate. Setup zero costuri de licențiere, scalează ușor, comunitate uriașă. Dar nu e plug-and-play – dacă vrei să faci treabă serioasă, intri în câteva concepte care la prima vedere par overkill pentru SMB.
[mai mult...]