Das Seminar erschließt den Themenbereich Fehleranalyse, Alarmierung und Troubleshooting innerhalb einer StarlingX-Plattform. Vermittelt wird eine schichtenorientierte Diagnose von Host-, Plattform-, Kubernetes-, Netzwerk-, Storage- und Anwendungsfehlern mit belastbarer Datensicherung und nachvollziehbaren Hypothesen.
Die Bearbeitung folgt einer durchgängigen technischen Reihenfolge: Ausgangslage erfassen, Komponenten und Abhängigkeiten einordnen, Konfiguration kontrolliert umsetzen, Zustand prüfen und typische Abweichungen systematisch eingrenzen. Demonstrationen und Laborübungen orientieren sich an realistischen Betriebs- und Integrationsaufgaben.
Inhaltsübersicht
- Diagnosemodell und Erstaufnahme
- Alarm- und Ereignisanalyse
- Host- und Plattformdienste
- Kubernetes und Anwendungen
- Netzwerk und Storage
- Datensammlung und nachhaltige Behebung
Zielgruppe
Second- und Third-Level-Support, Plattformadministration, SRE, Kubernetes-Administration und technische Betriebsverantwortung.
Voraussetzungen
Praxiserfahrung mit Linux, Kubernetes und StarlingX-Grundadministration; sichere Nutzung einer Shell.
Seminarziele
- Fehlerbilder nach Ebene, Auswirkung und Zeitverlauf strukturieren.
- Alarme, Ereignisse, Metriken und Logs zielgerichtet korrelieren.
- Hypothesen mit risikoarmen Tests bestätigen oder verwerfen.
- Störungen reproduzierbar dokumentieren und sauber eskalieren.
Seminarinhalte
1. Diagnosemodell und Erstaufnahme
- Symptom, Auswirkung, Beginn, Reichweite und letzte Änderungen präzise erfassen.
- Plattform-, Cluster-, Host- und Anwendungsebene als Diagnosebaum verwenden.
- Sofortmaßnahmen von Ursachenanalyse und dauerhafter Korrektur trennen.
2. Alarm- und Ereignisanalyse
- Alarmklassen, Schweregrade, Unterdrückung und aktive Fehlerzustände interpretieren.
- Ereignisse zeitlich sortieren und Folgealarme von wahrscheinlichen Primärursachen trennen.
- Alarmquittierung erst nach nachvollziehbarer technischer Bewertung durchführen.
3. Host- und Plattformdienste
- CPU, Speicher, Datenträger, Interfaces, Dienste und Kernelmeldungen prüfen.
- Controller- und Plattformdienstfehler anhand von Prozess- und Servicezuständen eingrenzen.
- Konfigurationsabweichungen und Ressourcenerschöpfung voneinander unterscheiden.
4. Kubernetes und Anwendungen
- Scheduling-, Image-, Netzwerk-, Storage- und Runtime-Fehler anhand von Podzuständen trennen.
- Events, Describe-Ausgaben und Containerlogs in der richtigen Reihenfolge auswerten.
- Rollout-, Probe- und Abhängigkeitsfehler mit minimalen Eingriffen reproduzieren.
5. Netzwerk und Storage
- Link-, VLAN-, MTU-, Routing-, DNS- und CNI-Probleme schrittweise isolieren.
- SR-IOV- und Multus-Zuordnungen vom Kubernetes-Objekt bis zum Host verfolgen.
- Ceph-Zustand, Volumes, Mounts und I/O-Fehler mit Workload-Symptomen korrelieren.
6. Datensammlung und nachhaltige Behebung
- Relevante Protokolle und Systeminformationen zeitlich konsistent sichern.
- Korrekturmaßnahmen mit Risiko, Rückfallpunkt und Erfolgskriterium planen.
- Ursache, Beitragfaktoren und Präventionsmaßnahmen in einem Störungsbericht dokumentieren.
Praktische Übungen
- Bearbeitung eines mehrschichtigen Fehlerfalls mit Alarm- und Zeitlinienanalyse.
- Diagnose eines nicht startenden Pods mit Netzwerk- und Storage-Abhängigkeit.
- Erstellung eines vollständigen technischen Störungsberichts einschließlich Hypothesenprüfung.
Geeignete Einsatzszenarien
- Aufbau eines standardisierten Troubleshooting-Verfahrens.
- Qualifizierung von Betriebs- und Supportteams für produktive Plattformen.
- Verbesserung von Eskalationen und Ursachenanalysen nach wiederkehrenden Störungen.
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Second- und Third-Level-Support, Plattformadministration, SRE, Kubernetes-Administration und technische Betriebsverantwortung. |
| Voraussetzungen: | Praxiserfahrung mit Linux, Kubernetes und StarlingX-Grundadministration; sichere Nutzung einer Shell. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
