Alertas sem fadiga com Prometheus e Alertmanager
Aprenda a criar alertas acionáveis com Prometheus e Alertmanager, usando SLO, burn rate, severidade, agrupamento, inibição, silêncios, roteamento e boas práticas para reduzir fadiga de alertas.
// 4 entradas Aprenda a criar alertas acionáveis com Prometheus e Alertmanager, usando SLO, burn rate, severidade, agrupamento, inibição, silêncios, roteamento e boas práticas para reduzir fadiga de alertas. Aprenda a desenhar uma arquitetura de OpenTelemetry Collector para Kubernetes em produção, com Agent, Gateway, tail sampling, filas, resiliência, escalabilidade e monitoramento do próprio pipeline. Aprenda a transformar métricas de observabilidade em SLIs, SLOs e Error Budgets úteis, com exemplos em .NET e Prometheus, alertas por burn rate e decisões práticas sobre confiabilidade. Aprenda a instrumentar aplicações .NET com logs, métricas e traces correlacionados, exportando telemetria via OTLP para um Collector no Kubernetes. O guia também cobre cardinalidade, sampling, segurança e decisões de arquitetura.Alertas sem fadiga com Prometheus e Alertmanager
OpenTelemetry Collector no Kubernetes em produção
SLI, SLO e Error Budget na prática
OpenTelemetry no .NET: observabilidade completa