Beobachtbarkeit muss technische Signale mit fachlichen Datenflüssen verbinden. Das Seminar entwickelt ein Betriebsbild aus Metriken, strukturierten Logs, verteilten Traces und Auditereignissen und überführt es in handlungsfähige Alarme.
Inhaltsübersicht
- Lernziele
- Modul 1: Messmodell und SLOs
- Modul 2: Metriken
- Modul 3: Strukturiertes Logging
- Modul 4: Tracing und Korrelation
- Modul 5: Audit und Sicherheitsbeobachtung
- Modul 6: Alarmierung und Incident-Diagnose
- Praxisübungen
- Zielgruppe
- Voraussetzungen
Lernziele
- Geeignete Service- und Geschäftsindikatoren definieren
- Logs und Traces über Korrelationsmerkmale zusammenführen
- Auditdaten für sicherheitsrelevante Änderungen auswerten
- Dashboards und Alarme mit klaren Betriebsaktionen erstellen
Seminarinhalte
Modul 1: Messmodell und SLOs
Beobachtbarkeit wird aus Nutzerwirkung, Datenpfad und Betriebszielen abgeleitet.
- Schritt 1: Kritische Nutzer- und Gerätepfade bestimmen
- Schritt 2: Verfügbarkeit, Latenz, Fehler und Vollständigkeit definieren
- Schritt 3: SLI, Zielwert und Messfenster festlegen
- Schritt 4: Fehlerbudget und Eskalationsschwelle dokumentieren
Modul 2: Metriken
Dienste, Broker, Consumer, Datenbanken und Regeln benötigen wenige, aussagekräftige Kennzahlen.
- Schritt 1: Golden Signals und fachliche Durchsatzwerte auswählen
- Schritt 2: Labels auf begrenzte, stabile Dimensionen beschränken
- Schritt 3: Grenzwerte aus Kapazität und Nutzerwirkung ableiten
- Schritt 4: Metriken in einem Dashboard nach Datenpfad gruppieren
Modul 3: Strukturiertes Logging
Logs erklären Ereignisse ohne Geheimnisse oder unkontrollierte Datenmengen.
- Schritt 1: Pflichtfelder, Zeitformat und Schweregrade vereinheitlichen
- Schritt 2: Korrelation, Client, Channel und Domain datenschutzgerecht erfassen
- Schritt 3: Fehler mit Ursache, Wirkung und nächstem Schritt protokollieren
- Schritt 4: Aufbewahrung, Zugriff und Maskierung festlegen
Modul 4: Tracing und Korrelation
Verteilte Traces zeigen Laufzeit und Fehler über Dienstgrenzen hinweg.
- Schritt 1: Trace- und Korrelationskontext am Eingang erzeugen oder übernehmen
- Schritt 2: Kontext über API, Broker und Consumer weitergeben
- Schritt 3: Spans für relevante externe Abhängigkeiten setzen
- Schritt 4: Langsame oder fehlerhafte Operation im Trace lokalisieren
Modul 5: Audit und Sicherheitsbeobachtung
Änderungen an Identitäten, Rollen, Richtlinien und Zugriffsmitteln werden separat bewertet.
- Schritt 1: Auditpflichtige Aktionen und Verantwortliche festlegen
- Schritt 2: Erfolgreiche und abgelehnte Änderungen erfassen
- Schritt 3: Auffällige Muster und privilegierte Nutzung alarmieren
- Schritt 4: Regelmäßige Auswertung und Nachweisverfahren definieren
Modul 6: Alarmierung und Incident-Diagnose
Alarme werden an Nutzerwirkung gekoppelt und führen zu einem konkreten Runbook.
- Schritt 1: Symptom, Schwelle und Mindestdauer definieren
- Schritt 2: Duplikate und Folgewarnungen zusammenfassen
- Schritt 3: Dashboard, Logs und Trace als Diagnosepfad verknüpfen
- Schritt 4: Störung anhand einer Zeitlinie eingrenzen und Maßnahme dokumentieren
Praxisübungen
- SLI- und SLO-Modell für einen Telemetriepfad
- Dashboard für Broker, API, Consumer und Speicherung
- Korrelation eines Fehlers über Log und Trace
- Audit-Alarm für kritische Berechtigungsänderungen
Zielgruppe
SRE-, DevOps- und Betriebsteams, Administratoren, Sicherheitsverantwortliche und Entwickler, die produktive Plattformen diagnostizierbar machen.
Voraussetzungen
Grundkenntnisse in Plattformbetrieb, Metriken und Logging; Erfahrung mit Prometheus oder OpenTelemetry ist hilfreich.
Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | SRE-, DevOps- und Betriebsteams, Administratoren, Sicherheitsverantwortliche und Entwickler, die produktive Plattformen diagnostizierbar machen. |
| Voraussetzungen: | Grundkenntnisse in Plattformbetrieb, Metriken und Logging; Erfahrung mit Prometheus oder OpenTelemetry ist hilfreich. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
