Was ich tue

Drei eng verwandte Disziplinen, durchgängig verantwortet - und nicht zwischen den Teams über den Zaun geworfen.

Notizen aus dem Feld

Praxisnahe Texte über Zuverlässigkeit, Architektur und den Betrieb echter Systeme - ohne Hype, ohne Thought-Leadership-Theater.

Git-Worktrees: ein Gehirn, viele Agenten parallel am Werk

Wenn mehrere Personen - oder mehrere KI-Agenten - gleichzeitig am selben Repo arbeiten, jeweils auf einem eigenen Branch, brauchst du keine N Klone und kannst auch keinen einzelnen Checkout teilen. Git-Worktrees geben dir eine Historie und viele Arbeitsverzeichnisse: eine einzige Quelle der Wahrheit, über die ein zentraler Agent nachdenken kann, während jeder Worker isoliert baut, testet und committet.

SLOs, die nicht lügen: messen, was Nutzer wirklich erleben

Die meisten SLOs sind grün, während die Nutzer leiden - sie messen das System, nicht den Menschen. Wie man SLIs aus echten User Journeys baut, jeder Journey das Ziel gibt, das sie verdient, den Spielraum in ein Fehlerbudget mit klarem Eigentümer verwandelt und Alerts verdrahtet, die direkt zur Ursache durchführen.

Alerts entwerfen, die niemand ignoriert

Laute Alerts bringen dem Team bei, ausgerechnet den zu ignorieren, der zählt. Ein tiefer, praxisnaher Leitfaden zu symptombasierten Alerts und Multi-Window-/Multi-Burn-Rate-Alerting - die Mathematik hinter der Burn Rate, kopierfertiges PromQL und der On-Call-Prozess, der Pages wieder vertrauenswürdig macht.

Haben Sie ein System, das nicht ausfallen darf?

Ob Architektur-Review, ein SRE-Engagement oder ein Zuverlässigkeitsbrand, den Sie löschen müssen - lassen Sie uns reden.

Kontakt aufnehmen

Finden Sie mich in den sozialen Medien