↑ ↓ para escolher · Enter abre · Esc fecha

A latência das operações subiu de forma perceptível nas últimas semanas, sem que tenhamos alterado a infraestrutura ou o volume de requisições. Não consigo isolar a causa raiz com as métricas atuais, e o comportamento é intermitente, o que dificulta a reprodução em ambiente de teste. Precisamos de um tracing mais granular para identificar o gargalo.

Conta em Plataforma e Sustentação × Disponibilidade e Performance, visão “Onde dói”.

Como a área foi escolhida

A probabilidade que o Jev deu a cada time. A área é a do time escolhido.

  • Observabilidade Plataforma e Sustentação 58%
  • Infra e Cloud Plataforma e Sustentação 28%
  • Nenhum destes 14%

e mais 22 com probabilidade menor.

Relato cruzado: quem relata é do time App, mas o objeto de que o evento fala é do time Observabilidade. Vale o dono: a área é Plataforma e Sustentação.

As 8 dimensões da classificação na v1
DimensãoRespostaConfiançaAlternativas
Área Plataforma e Sustentação › Observabilidade 86%
  1. Plataforma e Sustentação 86%
  2. Nenhum destes 14%
  3. Formalização 0%
Frente Disponibilidade e Performance › Degradação de Performance 100%
  1. Disponibilidade e Performance 100%
  2. Capacidade e Recursos 0%
  3. Segurança e Conformidade 0%
Natureza Reativo 97%
Severidade 0,49 Nível 1 (nível 2 de 4) 49%
Impacto esperado 0,55 Nível 2 (nível 3 de 4) não vale para esta natureza 63%
Causa raiz Falta de Observabilidade 100%
Urgência 0,17 sem confiança
Problema Sem problema 100%