Resolved -
✅ Incidente resolvido
Período do Incidente:
O incidente foi identificado às 11h25, quando foi observado que o serviço Redis atingiu 100% de utilização de memória.
As ações corretivas foram concluídas às 12h45, com a normalização completa do ambiente.
Impacto: Não houve impacto para os usuários finais.
O comportamento foi identificado e tratado preventivamente antes que pudesse causar degradação perceptível na plataforma.
Causa Identificada: O serviço Redis atingiu 100% da utilização de memória
A causa foi relacionada ao incidente anterior, que gerou um atraso na replicação dos dados.
Como consequência, parte dos dados de cache permaneceu acumulada no Redis sem ser processada adequadamente, ocasionando o consumo excessivo de memória.
Ações Realizadas: Foi executado um flushall no Redis para remover os dados acumulados que estavam pendentes de processamento.
Também foi realizado o restart do banco de dados DW, garantindo a normalização dos serviços relacionados ao processo de replicação e processamento de dados.
Status Atual
O incidente encontra-se resolvido.
O ambiente segue sob monitoramento para garantir a estabilidade dos serviços e prevenir novas ocorrências relacionadas ao processamento e replicação de dados em cache.
Jul 7, 13:08 GMT-03:00
Monitoring -
🚨 Atualização do incidente
Equipe Clinicarx realizou uma ação corretiva ao problema que estamos tendo e no momento estamos monitorando as métricas.
Serviços afetados: Aplicação principal
Horário de início: 11:45
Nossa equipe já está atuando para restaurar a normalidade. Próxima atualização em breve.
Jul 7, 11:55 GMT-03:00
Identified -
🔍 Atualização do incidente
A causa raiz foi identificada e, no momento o time está realizando uma ação para a limpeza do cache do Redis.
Impacto: Possível lentidão ao se iniciar atendimento
Serviços afetados: Aplicação principal
Próxima atualização prevista para: 12:00
Agradecemos a sua compreensão!
Equipe Clinicarx
Jul 7, 11:49 GMT-03:00