Tempo estimado de leitura: 4 minutos Publicado em 2 de outubro de 2026
Escolha a jornada para proteger
Descreva a ação essencial, o público e as dependências que podem interrompê-lo. Um site de negócios pode precisar que os visitantes leiam uma oferta e enviem consultas; Uma loja precisa de pedidos registrados corretamente. Separe o carregamento da página, a conclusão da ação e o manuseio subsequente, pois essas etapas podem falhar de forma diferente.
Os pasta de trabalho do google sre Descreve os objetivos do serviço com base em indicadores e concordância entre as partes interessadas. Adapte a abordagem ao tamanho do site. Uma pequena equipe pode começar com uma jornada, um indicador observável e um proprietário, em vez de muitos painéis sem decisões associadas.
Definir eventos e janelas de observação
Escreva o que conta como uma tentativa e sucesso, onde é observado e quais exclusões são justificadas. A entrada deliberadamente inválida difere da perda de uma consulta válida. O monitoramento sintético e o uso real observam populações diferentes; Mantenha seus resultados separados.
Defina a janela de leitura e o mínimo de evidência útil. As porcentagens são instáveis com poucos eventos em um site de baixo tráfego. Mostrar tentativas e falhas contabilizadas juntamente com a taxa e investigar casos reproduzíveis. Evite coletar mensagens desnecessárias ou informações pessoais para medir um resultado técnico.
Escolha um objetivo antes de assumir um compromisso
Um objetivo interno descreve um nível desejado e orienta as decisões. Um compromisso contratual tem alcance e consequências que exigem um acordo separado. Evite adotar uma alta porcentagem apenas porque parece reconfortante. Compare as necessidades dos visitantes, as restrições operacionais e os custos de recuperação.
Em um cálculo ficcional, 10 falhas entre 1.000 tentativas produzem 99% de sucesso. Isso não descreve a duração, as pessoas afetadas ou a gravidade: contagens idênticas podem representar inconveniências menores ou pedidos perdidos. A disponibilidade baseada em tempo requer uma definição diferente; Não converta indicadores sem explicar o método.
Conectar limites às ações
Decida quem investiga os alertas, quais evidências estabelecem um incidente e como as pessoas afetadas são informadas. Uma interrupção confirmada pode exigir uma solução alternativa ou uma reversão. Um alerta isolado pode precisar de verificação antes do escalonamento. Reduza a incerteza e o tempo de resposta, em vez de gerar mensagens para cada flutuação.
A qualidade do documento diminui durante as alterações. Os Capítulo de política de orçamento de erro Descreve as respostas acordadas a lacunas de confiabilidade. Um pequeno site pode simplesmente atrasar uma mudança opcional até que um defeito crítico seja resolvido sem reivindicar a implementação do modelo operacional de um grande serviço.
Verifique os observadores e revise os incidentes
Test Monitoring em si: distingue a disponibilidade da página das ações concluídas? Ele pode detectar uma notificação perdida? Ele emite um alerta compreensível que recebe uma resposta? Cenários disruptivos pertencem a ambientes autorizados. As verificações de produção devem evitar pedidos fictícios e mensagens acidentais.
Após incidentes, conecte cronogramas, impacto, correções e verificações de regressão. Revise os indicadores se as falhas escaparem à detecção. Os Guia de resposta a incidentes e Registro de aceitação Ajude a atribuir ações e reter as descobertas. Objetivos úteis evoluem com jornadas e riscos observados.
Documentos de referência
Conteúdo atualizado em 2 de outubro de 2026
Registe as verificações e os resultados no registo de testes web