Praxis etablieren
Lege Kadenz, Owner, Teilnahme und Erfolgssignale für eine wiederkehrende Team-Praxis fest.
Praxis etablieren
Lege Kadenz, Owner, Teilnahme und Erfolgssignale fest, damit die Methode als wiederkehrende Team-Praxis funktioniert.
Variante für Operative Praxis. Der Plan leitet sich aus Methodenform, Methodenschritten und Runsheet ab.
RunsheetEine operative Praxis wirkt durch Wiederholung. Die Kadenz sollte klein genug sein, um verlässlich gehalten zu werden.
Die Schritte beschreiben eine einzelne Wiederholung und werden nach dem Review angepasst.
- 1
Phase 1: Aktivierung
0-5 minErster Responder übernimmt IC-Rolle und postet im Channel: ich bin IC, Severity X, Hypothese Y. Channel-Topic mit IC-Name aktualisieren. Pager-Alarm bestätigen.
OwnerWenn niemand IC übernimmt, eskaliert der Pager nach 5 min. IC-Übernahme ist explizit, nicht implizit. Kein „kümmert sich schon jemand?“. - 2
Phase 2: Rollen besetzen
5-15 minIC ruft Operations Lead und Communications Lead. Scribe wird benannt. SMEs werden gezielt gepagert, nicht das ganze Team. Conference-Bridge wird gestartet, Channel bleibt das Hauptmedium.
TeamIC bleibt Koordinator, nicht Operator. Wenn IC selbst tippt, fehlt jemand für den Überblick. Bei SEV1 sofort separaten OL benennen. - 3
Phase 3: Investigation und Mitigation
variabelOL führt Hypothesen-Tests, Scribe protokolliert mit Zeitstempel. IC koordiniert: was wurde getestet, was ist die nächste Aktion, wer macht. CL postet alle 30 min Status-Updates an Stakeholder.
TeamMitigation schlägt Ursachenfindung. Wenn ein Rollback verfügbar ist, OL rollt zurück, Ursachenanalyse folgt im Postmortem. Keine parallelen Aktionen ohne IC-Bestätigung. - 4
Phase 4: Resolution und Hand-off
15 minIC bestätigt Recovery anhand SLO-Metriken, nicht anhand Bauchgefühl. Channel-Topic auf Resolved. Status-Page geschlossen. Bei langem Incident vorher Hand-off mit Übergabe an neuen IC alle 2 h.
TeamRecovery braucht zwei aufeinanderfolgende grüne Mess-Intervalle. Wenn nur ein Tick grün ist, bleibt der Incident offen. Hand-off mit explizitem Übergabe-Statement (Status, offene Punkte, nächste Schritte). - 5
Phase 5: Übergabe an Postmortem
15 min nach ResolutionIC erstellt Postmortem-Ticket mit Incident-ID, verlinkt Channel-Log und Timeline. Postmortem-Termin binnen 5 Werktagen. Action Items aus dem Incident vorab im Ticket gesammelt.
TeamWer den Channel verlässt, bevor das Postmortem-Ticket existiert, riskiert dass die Lessons verloren gehen. Scribe ist verantwortlich für vollständigen Log-Export.
Practice Charter
Kopierbare Charter mit Zweck, Kadenz, Owner, Teilnahme, Ablauf, Erfolgssignalen und Review.
practice-charter.md
Practice Charter: Incident Command
Zweck
Bei einem akuten Incident mit mehreren Beteiligten schafft die Methode eine klare Führungs- und Kommunikationsstruktur. Sie reduziert Chaos, wenn schnelle Koordination und saubere Lageführung gleichzeitig gebraucht werden.
Kadenz
wöchentlich
Owner und Teilnahme
- Owner: offen
- Teilnehmende: 4-15
- Modus: synchron
Ablauf je Iteration
- Phase 1: Aktivierung (0-5 min) Erster Responder übernimmt IC-Rolle und postet im Channel: ich bin IC, Severity X, Hypothese Y. Channel-Topic mit IC-Name aktualisieren. Pager-Alarm bestätigen.
- Phase 2: Rollen besetzen (5-15 min) IC ruft Operations Lead und Communications Lead. Scribe wird benannt. SMEs werden gezielt gepagert, nicht das ganze Team. Conference-Bridge wird gestartet, Channel bleibt das Hauptmedium.
- Phase 3: Investigation und Mitigation (variabel) OL führt Hypothesen-Tests, Scribe protokolliert mit Zeitstempel. IC koordiniert: was wurde getestet, was ist die nächste Aktion, wer macht. CL postet alle 30 min Status-Updates an Stakeholder.
- Phase 4: Resolution und Hand-off (15 min) IC bestätigt Recovery anhand SLO-Metriken, nicht anhand Bauchgefühl. Channel-Topic auf Resolved. Status-Page geschlossen. Bei langem Incident vorher Hand-off mit Übergabe an neuen IC alle 2 h.
- Phase 5: Übergabe an Postmortem (15 min nach Resolution) IC erstellt Postmortem-Ticket mit Incident-ID, verlinkt Channel-Log und Timeline. Postmortem-Termin binnen 5 Werktagen. Action Items aus dem Incident vorab im Ticket gesammelt.
Erfolgssignale
Incident Log, Action Tracker, Stakeholder Updates
Review
4 Wochen