// downtime

Downtime: o tempo em que o site não estava lá.

É a palavra mais usada deste assunto e a que menos gente sabe medir. O número que aparece num relatório depende inteiramente de decisões que ninguém escreve — a começar por de quanto em quanto tempo alguém foi ver.

// downtime Downtime é o período em que um site ou serviço não respondeu como devia, medido do primeiro pedido falhado ao primeiro pedido bem sucedido a seguir.

A definição é simples e a medição não é. Ninguém observa um site continuamente: observa-se por amostragem, a intervalos. Isso quer dizer que o downtime medido nunca é o downtime real — é o downtime que a amostragem conseguiu ver, e a diferença entre os dois é exactamente o intervalo entre verificações.

Uma ferramenta que verifica de cinco em cinco minutos não consegue distinguir uma falha de dez segundos de uma de quatro minutos e meio. Se a falha começar logo a seguir a uma verificação bem sucedida, ela só passa a existir na verificação seguinte — e a partir daí conta como se tivesse começado nesse momento. É por isso que o intervalo não é um detalhe técnico: é a definição prática do que o número quer dizer.

Há uma segunda decisão que quase nunca é escrita: o que conta como downtime. Um erro 500 conta, claramente. Um site que responde mas demora oito segundos, provavelmente também devia contar, e quase nunca conta. Uma manutenção combinada não devia contar, e conta se ninguém a marcar. Duas ferramentas honestas podem dar números diferentes para o mesmo mês só por causa disto.

A consequência para quem gere sites de clientes é directa: um número de downtime só significa alguma coisa acompanhado do intervalo de verificação e da regra do que conta. Sem esses dois, é uma percentagem bonita sem conteúdo — e não aguenta a primeira pergunta de alguém que queira mesmo saber.

// o que decide o número

Quatro decisões que mudam o downtime medido.

Nenhuma delas é sobre o site. Todas são sobre quem está a medir — e é por isso que dois relatórios do mesmo mês podem não bater certo.

  • O intervalo entre verificações

    Cinco minutos, um minuto, trinta segundos. Define a precisão e define o atraso do aviso. É a definição com mais efeito no número final e a que menos aparece nos relatórios.

  • Quantas falhas seguidas contam como incidente

    Confirmar a falha com um segundo pedido evita contar soluços da rede como incidentes. Custa alguns segundos de atraso no aviso e evita a maior parte dos falsos positivos — que é uma troca que vale sempre a pena.

  • O que se considera uma resposta boa

    Só o código 200, ou também os redireccionamentos? Um site que responde 200 com uma página de erro dentro conta como de pé? A regra existe sempre, mesmo quando ninguém a escreveu.

  • De onde se verifica

    Um problema de rota entre um datacenter e o teu servidor aparece como downtime a quem verifica de lá e não aparece a mais ninguém. Um ponto de verificação só é mais simples de explicar e menos completo — e quem verifica de um ponto só devia dizer qual é.

// o que isto não é

E o que o termo não cobre.

Metade de uma definição útil é a fronteira. Estes quatro casos ficam de fora, e é onde as conversas costumam descarrilar.

  • Downtime não é lentidão. Um site que demora oito segundos a responder está tecnicamente de pé e, para quem o visita, está praticamente em baixo. Nenhum número de disponibilidade apanha isso.
  • Downtime medido de fora não vê o que está avariado por dentro. Um site que responde 200 com o checkout partido conta como cem por cento de disponibilidade — e está errado na prática.
  • Uma percentagem não diz quando aconteceu. 43 minutos seguidos num sábado à noite e 43 minutos espalhados por uma terça de manhã dão o mesmo número e não são a mesma coisa.
  • Downtime não explica a causa. Diz que houve falha e quanto tempo durou. O porquê está nos logs do servidor, e nenhuma ferramenta de verificação externa lhes chega.

// perguntas

O que nos perguntam sobre isto.

Quanto downtime é normal num site pequeno?

Não há um valor normal, há o que o teu alojamento consegue entregar. Um alojamento partilhado decente anda acima dos 99,9%, o que dá cerca de 43 minutos de falha por mês. O que interessa menos é o número e mais a distribuição: uma falha de 43 minutos numa segunda de manhã é pior para um negócio do que quatro de dez minutos de madrugada.

Como é que se calcula a percentagem de uptime a partir do downtime?

Uptime é o tempo total do período menos o downtime, a dividir pelo tempo total. Num mês de 30 dias são 43 200 minutos; 43 minutos de falha dão 99,90%. A conta é trivial — a parte difícil é ter o registo dos 43 minutos.

Vale a pena medir downtime num site que quase não tem visitas?

Vale se alguém te vai perguntar por ele. Num site sem visitas, o custo do downtime é quase nulo enquanto ninguém repara — e é exactamente por isso que ele costuma durar dias. Se há uma avença por trás, a pergunta chega mais cedo ou mais tarde.

Da definição para o número.

Medir downtime a sério exige duas coisas que as ferramentas gratuitas cortam primeiro: um intervalo curto e um histórico que dure. A De Olho vai verificar ao minuto e guardar desde o primeiro dia, sem apagar aos três meses — porque é precisamente o registo antigo que serve quando alguém pergunta por Março. Abre em 2026.

Entretanto, o "Está em baixo, ou és só tu?" faz a verificação uma vez, sem conta e sem custo. É a mesma verificação — o que falta é ela repetir-se sozinha.