Replicação duplica dados para redundância e performance. Read replicas distribuem carga. Failover automático garante uptime.
Conceitos Principais
Master-Slave
Master: writes. Slaves: reads. Async replication (lag). Failover manual ou auto.
Streaming Replication
WAL (Write-Ahead Log) streaming. Continuo, low lag. PostgreSQL built-in.
Sync vs Async
Sync: sem data loss, slow writes. Async: fast writes, possível data loss. Hybrid: quorum.
Failover
Master down → promote slave. Manual: DBA. Auto: Patroni, repmgr. DNS update, app reconnect.
Passo a Passo
Boas Praticas
Recomendacoes
• Múltiplas replicas (N+2 redundancy)
• Auto failover (Patroni)
• Monitor replication lag
• Async para performance, sync para critical
• Test failover regularmente
• Connection pooling
Erros Comuns
Evite estes erros
• Single replica (not HA)
• Não monitorar lag
• Failover não testado
• Writes na replica
• Não atualizar app config em failover