↑ ↓ para escolher · Enter abre · Esc fecha

A latência das operações subiu de forma perceptível nas últimas semanas, sem que tenhamos alterado a infraestrutura ou o volume de requisições. Não consigo isolar a causa raiz com as métricas atuais, e o comportamento é intermitente, o que dificulta a reprodução em ambiente de teste. Precisamos de um tracing mais granular para identificar o gargalo.

Conta em Plataforma e Sustentação × Disponibilidade e Performance, visão “Onde dói”.

Como a área foi escolhida

A probabilidade que o Jev deu a cada time. A área é a do time escolhido.

  • Observabilidade Plataforma e Sustentação 69%
  • Infra e Cloud Plataforma e Sustentação 23%
  • Nenhum destes 7%

e mais 22 com probabilidade menor.

Relato cruzado: quem relata é do time App, mas o objeto de que o evento fala é do time Observabilidade. Vale o dono: a área é Plataforma e Sustentação.

As 8 dimensões da classificação na v2
DimensãoRespostaConfiançaAlternativas
Área Plataforma e Sustentação › Observabilidade 92%
  1. Plataforma e Sustentação 92%
  2. Nenhum destes 7%
  3. Formalização 0%
Frente Disponibilidade e Performance › Degradação de Performance 100%
  1. Disponibilidade e Performance 100%
  2. Capacidade e Recursos 0%
  3. Integridade e Consistência de Dados 0%
Natureza Reativo 96%
Severidade 0,48 Nível 1 (nível 2 de 4) 53%
Impacto esperado 0,52 Nível 2 (nível 3 de 4) não vale para esta natureza 56%
Causa raiz Falta de Observabilidade 100%
Urgência 0,16 sem confiança
Problema Sem problema 100%