Sentry: monitoramento de erros, performance e session replay em produção
SDK de instrumentação, grouping de erros, traces de performance e session replay. Como configurar o Sentry para máxima visibilidade sem degradar performance.
SDK de instrumentação, grouping de erros, traces de performance e session replay. Como configurar o Sentry para máxima visibilidade sem degradar performance.
PromQL, LogQL, correlação de métricas/logs/traces e alertas. Como construir dashboards que revelam o estado real de sistemas distribuídos em produção.
Os 4 golden signals do SRE, histogramas, percentis e como definir SLOs/SLAs baseados em dados reais de produção.
SDK multi-linguagem, exporters para Jaeger/Zipkin/OTLP e correlação automática entre sinais. Como migrar de instrumentação proprietária para o padrão aberto.
Propagação de contexto, sampling, análise de latência e identificação de gargalos entre serviços. Implementação prática com OpenTelemetry e Jaeger.
Como definir SLOs realistas, calcular error budgets e usar os dados para priorizar trabalho de confiabilidade vs. novas features. O framework SRE na prática.
Availability, latency, throughput, error rate: como escolher SLIs que representam a experiência real do usuário e são tecnicamente mensuráveis.
RPS, TPS, concorrência, filas e back pressure. Como medir throughput real em produção, identificar gargalos e planejar capacidade para crescimento.
Os três pilares da observabilidade — metrics, logs e distributed traces — e como o OpenTelemetry padroniza instrumentação entre linguagens. Inclui estratégias de sampling para não afundar no custo de ingestão.
Log em texto livre não escala para busca. JSON estruturado com campos fixos (level, timestamp, traceId, service) permite queries precisas no Elasticsearch ou Loki. Entenda correlation ID propagation em microserviços e sampling de logs verbosos.
Monitoramento responde perguntas predefinidas; observabilidade permite fazer perguntas novas sobre estado que você não conhecia antes. Entenda como instrumentar código com spans do OpenTelemetry para ter traces end-to-end em sistemas distribuídos.