Grafana: dashboards de observabilidade com Prometheus, Loki e Tempo
PromQL, LogQL, correlação de métricas/logs/traces e alertas. Como construir dashboards que revelam o estado real de sistemas distribuídos em produção.
PromQL, LogQL, correlação de métricas/logs/traces e alertas. Como construir dashboards que revelam o estado real de sistemas distribuídos em produção.
RED (Rate, Errors, Duration) é para serviços; USE (Utilization, Saturation, Errors) é para recursos. Entenda como definir SLIs que mapeiam para experiência do usuário, alertar em burn rate de error budget e evitar alert fatigue.