Produktionsreife Architektur mit Control-Plane- und etcd-Quorum, Failure Domains, stabilem Kubernetes-API-Endpunkt, Worker-Pools, Kapazitätsreserven, Wartungsstrategie, Ausfalltests und technischer Freigabe.
Inhaltsverzeichnis
- Zielsetzung und Einsatzbereich
- Zielgruppe und Vorkenntnisse
- Seminarinhalte
- Verfügbarkeitsziele und Fehlerdomänen
- Control Plane und etcd-Quorum
- Stabiler Kubernetes-API-Endpunkt
- Worker-Pools und Scheduling
- Kapazitäts- und Reservenplanung
- Cordon, Drain, Reboot und Wartung
- Ausfalltests und Produktionsabnahme
- Praxisübungen
- Methodik und Zeitbedarf
Zielsetzung und Einsatzbereich
Das Seminar vermittelt einen reproduzierbaren Arbeitsablauf von der technischen Einordnung über Planung und Umsetzung bis zur belastbaren Prüfung. Entscheidungen werden anhand von Abhängigkeiten, Risiken, Freigabepunkten und Rückfallmöglichkeiten dokumentiert.
Zielgruppe und Vorkenntnisse
Teilnehmerkreis: Kubernetes- und Talos-Architektur, Plattformadministration, SRE, Infrastruktur- und Netzwerkverantwortliche.
Voraussetzungen: Talos-Installationserfahrung, gute Kubernetes-Kenntnisse und Verständnis von etcd, Load Balancern, DNS und Ausfallzonen.
Seminarinhalte
- Verfügbarkeitsziele und Fehlerdomänen
- Control Plane und etcd-Quorum
- Stabiler Kubernetes-API-Endpunkt
- Worker-Pools und Scheduling
- Kapazitäts- und Reservenplanung
- Cordon, Drain, Reboot und Wartung
- Ausfalltests und Produktionsabnahme
1. Verfügbarkeitsziele und Fehlerdomänen
- SLO, RTO, RPO und zulässige Wartungsunterbrechungen festlegen.
- Host-, Rack-, Strom-, Netzwerk-, Storage- und Standortausfälle modellieren.
- Control Plane, Worker und Plattformdienste auf unabhängige Failure Domains verteilen.
- Externe Abhängigkeiten in die Verfügbarkeits- und Wiederanlaufplanung aufnehmen.
2. Control Plane und etcd-Quorum
- Ungerade Mitgliederzahl, Mehrheitsquorum und Auswirkungen einzelner Ausfälle erklären.
- Latenz, I/O, Netzwerkstabilität und Ressourcenreserven für etcd bewerten.
- Mitgliedsausfall, Quorumverlust, Datenkorruption und Ersatz klar unterscheiden.
- Wartungs- und Ersatzreihenfolge ohne Verlust der Mehrheitsfähigkeit festlegen.
3. Stabiler Kubernetes-API-Endpunkt
- Direkte Endpunkte, Load Balancer und virtuelle IP anhand der Zielarchitektur vergleichen.
- DNS-Namen, Zertifikats-SANs, Health Checks und Zielgruppen konsistent konfigurieren.
- Failover bei Control-Plane- und Load-Balancer-Ausfall praktisch testen.
- Clientzugriff, Monitoring und Automatisierung gegen den stabilen Endpunkt ausrichten.
4. Worker-Pools und Scheduling
- Worker nach Hardware, Zone, Sicherheitsbedarf und Workloadklasse strukturieren.
- Labels, Taints, Affinity und Topology Spread für kontrollierte Verteilung einsetzen.
- PodDisruptionBudgets und Replikate an Wartungs- und Ausfallziele anpassen.
- Lokale Daten und zustandsbehaftete Workloads gesondert behandeln.
5. Kapazitäts- und Reservenplanung
- Nutzlast, Systemreserve und Ausfallreserve getrennt dimensionieren.
- CPU, Arbeitsspeicher, Ephemeral Storage, Netzwerk, Storage und Control-Plane-Last berücksichtigen.
- Sättigungsschwellen, Forecasts und Scale-out-Zeitpunkte aus Messwerten ableiten.
- Kapazitätsverlust während Wartung oder Zonenstörung simulieren.
6. Cordon, Drain, Reboot und Wartung
- Quorum, verfügbare Replikate, lokale Daten und PodDisruptionBudgets vorab prüfen.
- Knoten cordonen und Workloads kontrolliert drainen.
- Dienst- oder Knotenrestart in dokumentierter Reihenfolge ausführen.
- Scheduling, Netzwerk, Storage und Systemdienste nach der Wartung validieren.
7. Ausfalltests und Produktionsabnahme
- Worker-, Control-Plane-, Link- und API-Endpunktausfälle kontrolliert auslösen.
- Auswirkungen auf Scheduling, etcd, Netzwerk, Storage und Workloads messen.
- Ersatz, Failover und Rückkehr in den Sollzustand durchführen.
- Ergebnisse gegen SLO, Abnahmekriterien und Betriebsrunbooks bewerten.
Praxisübungen
- HA-Referenzarchitektur entwerfen
- Stabilen API-Endpunkt konfigurieren und testen
- Control-Plane-Ausfall simulieren
- Knoten unter Workloadschutz warten
- Kapazität bei reduziertem Cluster testen
- Produktionsabnahmeprotokoll erstellen
Methodik und Zeitbedarf
Die Inhalte werden als fachlich strukturierter Vortrag, geführte Demonstration und schrittweise praktische Übung vermittelt. Jede Arbeitsphase endet mit technischen Prüfpunkten, dokumentierten Sollwerten und einer kontrollierten Fehler- oder Rückfallsituation.
Drei Tage sind erforderlich, um Topologie, API-Endpunkt, Scheduling, Kapazität, Wartung und mehrere Ausfalltests vollständig durchzuführen.
Fachbereichsleitung / Trainerteam / Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Kubernetes- und Talos-Architektur, Plattformadministration, SRE, Infrastruktur- und Netzwerkverantwortliche. |
| Voraussetzungen: | Talos-Installationserfahrung, gute Kubernetes-Kenntnisse und Verständnis von etcd, Load Balancern, DNS und Ausfallzonen. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
