Monitoring
Sans monitoring, on debug à l'aveugle. Cette section couvre la stack LGTM (Loki, Grafana, Tempo, Prometheus) pour le monitoring moderne, check_mk pour les infras on-premise et Munin pour les vieux parcs.
Contenus
- LGTM - Stack simple - déployer Prometheus + Grafana + Loki from scratch
- LGTM - Métriques custom Node Exporter - exposer des métriques personnalisées
- LGTM - Alerting Loki - créer des alertes sur les logs
- LGTM - Tips - astuces et patterns pour la stack
- LGTM - Grafana Alloy - remplacer Promtail, pipelines logs/métriques/traces
- Thanos at scale - Receive par tenant, compactor en CronJob, spot et downsampling
- Les caches Thanos - mutualiser index cache, caching bucket et cache de résultats sur un backend partagé
- La concurrence de lecture Thanos - amplification du split et du fan-out, loi de Little et ordonnancement des limites
- check_mk - Notifications Slack - envoyer les alertes check_mk dans Slack
- Munin - configuration et plugins Munin
- Eztools - outils de monitoring légers