Plano de continuidade de negócios em TI: como montar o seu
Plano de continuidade de negócios em TI: o que é, o que deve conter e como montar o seu em 7 passos, com backup, disaster recovery e testes.
Leia mais
RTO (Recovery Time Objective) é o tempo máximo que a empresa aceita ficar parada depois de uma falha. RPO (Recovery Point Objective) é a quantidade máxima de dados que ela aceita perder, medida em tempo. Os dois são definidos pelo custo da parada de cada sistema e precisam estar no contrato do fornecedor de backup ou disaster recovery.
Quando o servidor cai, duas perguntas aparecem na hora: em quanto tempo a gente volta? e o que foi perdido? RTO e RPO são as respostas, combinadas antes do problema acontecer.
Sem esses dois números definidos, cada incidente vira improviso. Com eles, a empresa sabe o que esperar, quanto investir e o que cobrar do fornecedor.
RTO (Recovery Time Objective, ou objetivo de tempo de recuperação) é o tempo máximo que um sistema pode ficar fora do ar depois de uma falha, até voltar a funcionar.
Se o RTO do ERP é de 1 hora, a operação precisa estar de volta em até 1 hora depois da queda, seja por um ransomware, uma falha de hardware ou uma queda de energia.
RPO (Recovery Point Objective, ou objetivo de ponto de recuperação) é a quantidade máxima de dados que a empresa aceita perder, medida em tempo.
Se o RPO é de 24 horas, o backup roda uma vez por dia, e numa falha a empresa pode perder tudo o que foi feito desde a última cópia. Se o RPO é de 5 minutos, os dados são replicados a cada 5 minutos, e a perda máxima é dos últimos 5 minutos.
O RTO olha para frente: quanto tempo até voltar. O RPO olha para trás: até que ponto os dados são recuperados.
| RTO | RPO | |
|---|---|---|
| Pergunta que responde | Em quanto tempo voltamos? | Quanto dado podemos perder? |
| Medido em | Tempo de parada | Tempo desde a última cópia |
| O que define | Velocidade da recuperação | Frequência do backup ou da replicação |
| Exemplo | Voltar em até 1 hora | Perder no máximo 15 minutos |
Um não substitui o outro. Dá para ter um backup diário (RPO de 24 horas) que leva dois dias para ser restaurado (RTO de 48 horas). Os números precisam fazer sentido juntos.
Nem todo sistema precisa do mesmo nível de proteção. O que define é o impacto da parada:
| Sistema | Impacto se parar | RTO e RPO comuns |
|---|---|---|
| ERP, faturamento, PDV | Empresa para de vender e faturar | Minutos |
| Banco de dados de produção | Linha ou logística param | Minutos a 1 hora |
| Servidor de arquivos | Equipe trabalha com dificuldade | Algumas horas |
| E-mail e sistemas de apoio | Incômodo, sem perda direta de receita | Até 1 dia |
Um supermercado com o PDV parado ou uma indústria com o ERP fora do ar perdem dinheiro a cada minuto. Para esses sistemas, backup diário não basta: é preciso uma contingência pronta para assumir.
Para estimar o custo da parada, use a calculadora da página de disaster recovery: informe o faturamento mensal e as horas de operação.
O backup protege os dados: é uma cópia para restaurar quando algo se perde. O RPO depende da frequência das cópias, e o RTO depende do tempo de restauração, que pode levar horas ou dias quando o volume é grande.
O disaster recovery (DR, ou DRaaS quando é contratado como serviço) protege a operação: mantém um ambiente de contingência replicado e pronto para assumir. É ele que entrega RTO e RPO de minutos.
Na prática, as empresas que não podem parar usam os dois: backup em nuvem, com uma cópia imutável contra ransomware, e DR para os sistemas críticos.
A Acqualinda, empresa do setor de lazer, implantou o DRaaS da DATACOR para proteger o ERP e o sistema de armazenagem durante uma manutenção programada de energia. O resultado:
No DRaaS da DATACOR, o ambiente é replicado a cada 5 minutos para um data center no Brasil, que pode ficar em outra cidade. Se o ambiente principal cair, a contingência assume em média em 5 minutos, conforme a estrutura. Os testes são periódicos, numa frequência combinada com você, e o RTO e o RPO ficam definidos em contrato.
RTO (Recovery Time Objective) é o tempo máximo que um sistema pode ficar parado depois de uma falha. RPO (Recovery Point Objective) é a quantidade máxima de dados que a empresa aceita perder, medida em tempo desde a última cópia.
Os dois. RTO baixo significa voltar rápido; RPO baixo significa perder pouco dado. Quanto menores, maior o investimento, por isso o ideal é definir por sistema, de acordo com o custo da parada.
Um backup diário entrega RPO de até 24 horas: numa falha, pode-se perder tudo o que foi feito desde a última cópia. Para RPO de minutos, é preciso replicação contínua, como no disaster recovery.
Sim. Sem os números por escrito, não há como cobrar o fornecedor numa falha. Na DATACOR, o RTO e o RPO ficam definidos em contrato.
Depende do tamanho do ambiente e do número de sistemas. O primeiro passo é um diagnóstico consultivo, que mapeia os sistemas críticos e define o RTO e o RPO de cada um.
Plano de continuidade de negócios em TI: o que é, o que deve conter e como montar o seu em 7 passos, com backup, disaster recovery e testes.
Leia maisPlanejamento de TI para 2027: as prioridades de infraestrutura, um checklist do que revisar e como montar o orçamento de TI sem surpresas no ano que vem.
Leia maisColocation ou cloud? Compare controle, custo, crescimento e gestão de cada modelo e veja quando vale levar o seu servidor para o data center ou migrar para a nuvem.
Leia mais