From PWDEV DevOps — Plataforma, Operação e Incidente
Backup, restore, snapshot, PITR, retenção e plano de recuperação de desastre — S3, Glacier, RDS, PBS, pg_dump, WAL. Use quando o usuário disser "backup", "restore", "restaurar", "snapshot", "PITR", "desastre", "DR", "RTO", "RPO", "perdemos dado".
How this skill is triggered — by the user, by Claude, or both
Slash command
/pwdev-devops:backup-drThe summary Claude sees in its skill listing — used to decide when to auto-load this skill
Você garante que dá para voltar. É o domínio onde a falha só aparece no pior dia.
Você garante que dá para voltar. É o domínio onde a falha só aparece no pior dia.
Backup nunca restaurado não é backup — é esperança.
A pergunta não é "temos backup?". É "quando foi o último restore testado, e quanto tempo levou?".
3 cópias do dado
2 mídias ou serviços diferentes
1 fora do local principal
Snapshot na mesma conta AWS não é cópia externa. Backup no mesmo storage Ceph do dado não protege contra falha do storage.
| Termo | Pergunta | Define |
|---|---|---|
| RTO | quanto tempo até voltar? | procedimento e automação |
| RPO | quanto dado posso perder? | frequência do backup |
RPO de 1 hora com backup diário é inconsistente. Se o negócio não aceita perder 24h, o backup diário não atende — e isso precisa ser dito.
pg_dump -Fc -d base > base.dump # lógico
pg_restore -d base_nova base.dump # teste em base separada
PITR exige WAL archiving contínuo (archive_mode=on). Sem WAL, o ponto de
recuperação é o último dump — não existe "recuperar até 5 minutos atrás".
aws rds describe-db-snapshots --db-instance-identifier X
aws rds describe-db-instances --query 'DBInstances[].[DBInstanceIdentifier,BackupRetentionPeriod]'
aws s3api get-bucket-versioning --bucket X
Retenção 0 no RDS significa sem backup automático. Verifique sempre.
Trimestral, no mínimo. Registre:
Data: {{}} · Origem: {{backup de que dia}}
Destino: {{ambiente isolado}}
Tempo até restaurar: {{}} ← este é o seu RTO real
Dado íntegro? {{verificação feita}}
Falhas encontradas: {{}}
RTO real é o que o teste mostrou, não o que está no documento.
O último item é o mais esquecido: backup que falha em silêncio há três meses é o cenário clássico de perda de dado.
postgres-dba · aws-architect · proxmox-engineer · reliability-engineer
Guides completion of development work by verifying tests, detecting environment, and presenting structured options for merge, PR, or cleanup.
Enforces test-driven development: write failing test first, then minimal code to pass. Use when implementing features or bugfixes.
Guides creation and editing of skills using test-driven development with pressure scenarios and subagents to verify agent compliance.
npx claudepluginhub pwdev-solucoes/pwdev-claude-marketplace --plugin pwdev-devops