O que faço
Três disciplinas estreitamente relacionadas, assumidas de ponta a ponta - e não atiradas por cima do muro entre equipas.
Programação
Software de nível de produção, construído com testes primeiro - com IA para avançar depressa sem cortar caminho.
- Backends e APIs (Django, Scala / Akka-HTTP)
- Desenvolvimento orientado a testes e arquitectura limpa
- Programação assistida por IA com revisão sénior
- Interfaces web, apps nativas e PWAs no CloudFront
SRE & Fiabilidade
Tornar os sistemas observáveis, resilientes e capazes de sobreviver - antes do incidente, não durante.
- SLOs, error budgets e alertas que não dão falsos alarmes
- Preparação para incidentes, runbooks e postmortems
- Observabilidade: métricas, registos, tracing
- Desempenho e custo sob carga real
Arquitectura Cloud & Automatização
Infra-estrutura como código, golden paths e pipelines que lhe permitem avançar depressa sem partir a produção.
- Arquitectura AWS e revisões well-architected
- Módulos Terraform e fundações reutilizáveis
- CI/CD, GitOps e segurança no deployment
- Segurança por concepção e privilégio mínimo
Notas do terreno
Escrita prática sobre fiabilidade, arquitectura e operação de sistemas reais - sem hype nem teatro de pensador influente.
Git worktrees: um cérebro, vários agentes a trabalhar em paralelo
Quando várias pessoas - ou vários agentes de IA - trabalham no mesmo repositório ao mesmo tempo, cada um no seu branch, não é preciso ter N clones e também não se pode partilhar um único checkout. Os worktrees do Git dão-lhe um único histórico e vários directórios de trabalho: uma única fonte da verdade sobre a qual um agente central pode raciocinar, enquanto cada trabalhador compila, testa e faz commit isoladamente.
SLOs que não mentem: medir o que os utilizadores realmente sentem
A maioria dos SLOs está verde enquanto os utilizadores sofrem - medem o sistema, não a pessoa. Como construir SLIs a partir de percursos reais do utilizador, dar a cada percurso o objectivo que merece, transformar a folga num orçamento de erro com dono, e ligar alertas que descem directamente à causa.
Desenhar alertas que ninguém ignora
Alertas ruidosos ensinam a equipa a ignorar o que importa. Um guia fundo e prático de alertas baseados em sintomas e em multi-janela / multi-burn-rate - as contas do burn rate, PromQL pronto a colar, e o processo de on-call que volta a tornar os pages dignos de confiança.
Tem um sistema que não pode ir abaixo?
Quer seja uma revisão de arquitectura, um trabalho de SRE ou um incêndio de fiabilidade que precisa de apagar - vamos falar.
Entre em contacto