Qué hago
Tres disciplinas estrechamente relacionadas, asumidas de principio a fin - no lanzadas por encima del muro entre equipos.
Programación
Software de nivel de producción, construido con tests primero - con IA para ir rápido sin atajos.
- Backends y APIs (Django, Scala / Akka-HTTP)
- Desarrollo guiado por tests y arquitectura limpia
- Programación asistida por IA con revisión sénior
- Interfaces web, apps nativas y PWAs en CloudFront
SRE y Fiabilidad
Hacer los sistemas observables, resilientes y capaces de sobrevivir - antes del incidente, no durante.
- SLOs, error budgets y alertas que no dan falsas alarmas
- Preparación ante incidentes, runbooks y postmortems
- Observabilidad: métricas, registros, trazado
- Rendimiento y coste bajo carga real
Arquitectura Cloud y Automatización
Infraestructura como código, golden paths y pipelines que le permiten avanzar rápido sin romper producción.
- Arquitectura AWS y revisiones well-architected
- Módulos de Terraform y bases reutilizables
- CI/CD, GitOps y seguridad en el despliegue
- Seguridad por diseño y mínimo privilegio
Notas del terreno
Escritos prácticos sobre fiabilidad, arquitectura y operación de sistemas reales - sin hype ni teatro de gurús.
Git worktrees: un solo cerebro, muchos agentes trabajando en paralelo
Cuando varias personas - o varios agentes de IA - trabajan a la vez sobre el mismo repositorio, cada uno en su propia branch, no necesitas N clones y tampoco puedes compartir un único checkout. Los worktrees de Git te dan un solo historial y muchos directorios de trabajo: una única fuente de verdad sobre la que un agente central puede razonar, mientras cada trabajador compila, prueba y hace commit de forma aislada.
SLOs que no mienten: medir lo que los usuarios sienten de verdad
La mayoría de los SLO están en verde mientras los usuarios sufren: miden el sistema, no a la persona. Cómo construir SLIs a partir de recorridos reales de usuario, dar a cada recorrido el objetivo que merece, convertir el margen en un presupuesto de error con dueño, y conectar alertas que bajan directas a la causa.
Diseñar alertas que nadie ignora
Las alertas ruidosas enseñan a tu equipo a ignorar la que importa. Una guía a fondo y práctica sobre alertas basadas en síntomas y en multi-ventana / multi-burn-rate - las cuentas del burn rate, PromQL listo para pegar y el proceso de on-call que vuelve a hacer fiables los pages.
¿Tiene un sistema que no puede caerse?
Ya sea una revisión de arquitectura, un trabajo de SRE o un incendio de fiabilidad que necesita apagar - hablemos.
Póngase en contacto