Guia de resiliência

Cópias de segurança e instantâneos de VPS: utilize ambos de forma deliberada

Um instantâneo de VPS é geralmente o estado capturado num dado momento dentro da plataforma de alojamento, enquanto uma cópia de segurança é uma cópia conservada para recuperação e, idealmente, guardada num domínio de falha independente. Nenhum destes termos garante coerência, armazenamento externo, conservação ou um restauro bem-sucedido; a implementação e os resultados dos testes importam mais do que a designação.

Factos principais

Vantagem do instantâneo
Reversão rápida durante uma alteração controlada
Vantagem da cópia de segurança
Recuperação com versões para além da plataforma principal
Falha frequente
Existe uma cópia, mas o restauro nunca foi testado
Objetivo do cliente
Ponto e tempo de recuperação definidos

Distinguir reversão de recuperação

Os instantâneos são práticos antes de uma atualização do sistema operativo, uma alteração da configuração ou uma breve experiência. Podem preservar rapidamente o estado de um disco virtual e simplificar a reversão. Contudo, um instantâneo guardado na mesma plataforma, conta ou sistema de armazenamento pode perder-se juntamente com o original, ser eliminado por um atacante ou expirar devido à política da plataforma.

Um programa de cópias de segurança mantém versões de acordo com uma periodicidade e um plano de conservação, protege-as da mesma falha que afeta a produção e inclui um método de restauro. As cópias adaptadas à aplicação também podem preservar a coerência da base de dados ou das transações com mais fiabilidade do que uma captura instantânea do disco coerente apenas em caso de falha abrupta.

  • Utilize instantâneos para proteção de curto prazo durante alterações.
  • Utilize cópias de segurança independentes para recuperar de eliminações, comprometimentos e falhas da plataforma.
  • Não considere réplicas como cópias de segurança se uma eliminação for imediatamente replicada.

Começar pelos objetivos de recuperação

O objetivo de ponto de recuperação define a quantidade de dados recentes que o serviço pode perder; o objetivo de tempo de recuperação define quanto pode demorar o restauro. Um RPO reduzido pode exigir registos frequentes da base de dados ou replicação em conjunto com cópias de segurança. Um RTO reduzido pode exigir infraestrutura preparada e automação ensaiada, e não apenas uma cópia criada todas as noites.

Inventarie a configuração, os segredos, os ficheiros das aplicações, as bases de dados, o armazenamento de objetos, o DNS, os certificados e as dependências externas. Decida o que pode ser recriado e o que tem de ser copiado. Uma cópia de um disco sem as chaves de encriptação ou as instruções de restauro pode deixar os dados inutilizáveis.

  • Defina o RPO e o RTO para cada serviço, não apenas para a empresa em geral.
  • Inclua no inventário as definições do plano de controlo e o DNS.
  • Documente as dependências e a ordem em que devem ser recuperadas.

Conceber para diferentes domínios de falha

Mantenha mais do que uma cópia útil, utilize mais do que um suporte ou sistema de armazenamento quando adequado e guarde pelo menos uma cópia separada do ambiente principal. Uma camada de conservação imutável ou offline pode ser valiosa contra ransomware ou tomada de controlo da conta. Encripte dados sensíveis das cópias de segurança durante a transmissão e em repouso e proteja as chaves separadamente.

Confirme se as cópias de segurança do fornecedor são facultativas, com que frequência são executadas, durante quanto tempo permanecem disponíveis, se o cliente pode iniciar o restauro e que separação geográfica ou de plataforma existe. Os dados dos planos no configurador em tempo real da VPSEverywhere.com são a fonte oficial; este guia não afirma que esteja incluída uma funcionalidade de cópia de segurança.

  • Evite que uma única credencial de conta possa eliminar a produção e todas as cópias de segurança.
  • Monitorize a conclusão, idade e tamanho dos trabalhos e os erros de restauro.
  • Aplique a conservação tanto às obrigações legais de eliminação como às necessidades de recuperação.

Comprovar a recuperação através de um teste de restauro

Restaure periodicamente os dados num ambiente isolado. Confirme que os ficheiros abrem, as bases de dados passam as verificações de integridade, as aplicações arrancam, os segredos estão disponíveis através do percurso de recuperação previsto e a monitorização deteta corretamente a instância de teste. Meça o tempo decorrido e compare-o com o RTO definido.

Após o teste, remova em segurança a cópia temporária e registe o resultado, os defeitos, o responsável e a data do próximo teste. Uma notificação verde do trabalho de cópia de segurança apenas comprova que o processo foi executado; só um exercício de restauro demonstra que o serviço consegue recuperar.

Fontes

  1. NIST SP 800-34 Rev. 1: guia de planeamento de contingência
Perguntas frequentes

Perguntas frequentes

Um instantâneo do fornecedor é uma cópia de segurança?

Pode ser uma das cópias de recuperação, mas não basta se partilhar com a produção a mesma conta, plataforma, armazenamento ou forma de eliminação. Pergunte qual é o prazo de conservação e que separação existe entre domínios de falha.

Com que frequência devo fazer uma cópia de segurança do VPS?

Determine a frequência a partir da perda máxima de dados tolerável. Um serviço com RPO de uma hora exige uma arquitetura diferente de um sítio estático que pode ser reconstruído a partir do código-fonte.

Tenho de parar uma base de dados para criar um instantâneo?

Depende da base de dados e do mecanismo de instantâneo. Utilize o método de cópia de segurança ou de suspensão de escrita suportado pela base de dados e confirme a coerência após o restauro.