Tempo de atividade do servidor
A MyQ Roger se dedica a manter uma meta de tempo de atividade de 99,9%; no entanto, os acordos de nível de serviço (SLAs) são personalizados para cada cliente e não garantem explicitamente essa métrica. Empregamos estratégias avançadas de alta disponibilidade (HA), aproveitando implantações em múltiplas zonas e arquiteturas com múltiplos pods para garantir a continuidade do serviço e minimizar possíveis períodos de inatividade em caso de interrupções operacionais.
Monitoramento do status do sistema em tempo real
Para aumentar a transparência e fornecer visibilidade em tempo real do desempenho do sistema, mantemos um site dedicado ao status que oferece informações atualizadas sobre a integridade do serviço. Essa plataforma permite que os clientes:
-
Monitorar o status do sistema ao vivo: visualizar métricas operacionais em tempo real e atualizações sobre incidentes.
-
Receber notificações proativas: Inscrever-se para receber alertas sobre degradação do serviço ou eventos de manutenção planejada.
-
Acessar relatórios históricos de tempo de atividade: analisar incidentes passados e tendências de desempenho para avaliar a confiabilidade.
Ao oferecer um site centralizado de status, fornecemos aos clientes informações oportunas e precisas, reforçando a confiança e possibilitando a tomada de decisões proativas em caso de interrupções.
Estratégias de backup
Estratégia de backup do Azure SQL
Empregamos uma estratégia de backup georedundante para bancos de dados do Azure SQL, garantindo resiliência e capacidade de recuperação dos dados. Os principais aspectos incluem:
-
Armazenamento georedundante: os backups são replicados em várias regiões para recuperação de desastres.
-
Política de retenção: os backups são retidos por vários meses, permitindo a recuperação de dados históricos.
-
Backups incrementais: uma janela de 14 dias para recuperação em um momento específico (PITR) permite a restauração granular de dados perdidos.
-
Personalização com base no SLA: os períodos de retenção e os objetivos de tempo de recuperação (RTO) variam de acordo com os SLAs específicos do cluster e podem ser adaptados para atender às necessidades do cliente.
Estratégia de backup do Azure Cosmos DB
Para o Azure Cosmos DB, implementamos mecanismos abrangentes de proteção de dados, especialmente para registros contábeis, garantindo a integridade e a rastreabilidade dos dados:
-
Relatórios completos de dados contábeis: Todas as transações contábeis, incluindo a contabilidade de tarefas para atividades de impressão, digitalização, cópia e fax, são totalmente registradas.
-
Rastreamento de dados históricos: nosso sistema permite o acompanhamento e o rastreamento de quaisquer registros contábeis relatados para garantir a conformidade e a auditabilidade.
-
Alta disponibilidade e redundância: a replicação multirregional integrada garante a continuidade e minimiza os riscos de perda de dados.
Ao implementar essas estratégias robustas de backup, protegemos os dados críticos da empresa e, ao mesmo tempo, oferecemos opções flexíveis de recuperação adaptadas aos SLAs específicos de cada cliente.
Cenários de desastre e plano de resposta
|
Cenário de desastre |
Estratégia de Mitigação |
Processo de recuperação |
|---|---|---|
|
Corrupção de dados |
PITR (Recuperação em um Momento Específico) |
Restaurar o banco de dados para o último estado válido conhecido |
|
Interrupção na região da nuvem |
Backups geo-redundantes e failover |
Mudança para a região secundária do Azure |
|
Falha no nó do Kubernetes |
Replicação automática de serviços no AKS |
Os pods são reescalonados para nós em bom estado |
|
Ataque cibernético (DDoS, ransomware etc.) |
WAF, Proteção contra DDoS do Azure e monitoramento de segurança |
Isolar sistemas comprometidos e restaurá-los a partir de backups não comprometidos |