Logs, métricas e traces: o que cada um responde
Pergunta
Quais os três pilares de observabilidade e que tipo de pergunta cada um responde melhor?
Resposta esperada
Logs: eventos discretos com contexto ('pedido 123 falhou: gateway retornou 502') — respondem 'o que aconteceu exatamente nesta requisição?'. Métricas: números agregados no tempo (taxa de erro, p95 de latência, uso de CPU) — respondem 'o sistema está saudável agora e como isso mudou?' e são baratas de guardar e alertar. Traces (distribuídos): o caminho de uma requisição por vários serviços, com tempo em cada trecho — respondem 'onde a latência foi parar nesse fluxo?'. Os três se complementam: a métrica dispara o alerta, o trace mostra qual serviço, o log mostra o erro específico.
Por que perguntam isso
Pergunta pleno/sênior. Resposta forte descreve o fluxo de investigação (métrica alerta → trace localiza → log detalha), não só define os três.