Seminar / Training
Dieses Seminar behandelt Oozie Coordinator als Kernbaustein für wiederkehrende Verarbeitung. Statt einzelne Workflows manuell zu starten, werden Frequenzen, Zeitfenster, Datasets, Eingabe- und Ausgabedaten sowie Nachläufe modelliert. Genau hier trennt sich brauchbares Scheduling von nächtlichem Glücksspiel.
Inhaltsübersicht
- Coordinator-Konzept und Job-Lebenszyklus
- Frequenzen, Timezones und nominale Zeiten
- Dataset-Modellierung und Datenabhängigkeiten
- Materialisierung, Catch-up und Nachläufe
- Fehlerbilder und betriebliche Kontrolle
Schrittweise Seminarinhalte
- Schritt 1: Workflow und Coordinator fachlich voneinander abgrenzen.
- Schritt 2: Frequenzen, Start- und Endzeitpunkte sowie Zeitzonen sauber festlegen.
- Schritt 3: Datasets für Eingabe- und Ausgabedaten mit Pfadmustern modellieren.
- Schritt 4: Datenabhängigkeiten und Verfügbarkeitsfenster realistisch konfigurieren.
- Schritt 5: Coordinator materialisieren, starten, pausieren, fortsetzen und beenden.
- Schritt 6: Catch-up, Nachläufe und verspätete Datenfälle bewerten.
- Schritt 7: Fehlerzustände analysieren und geeignete Wiederanlaufregeln festlegen.
Praxisübungen
- Erstellung eines täglichen Coordinators für partitionierte Eingangsdaten
- Test verspäteter Datenlieferungen und definierter Nachläufe
- Analyse von Coordinator-Status und Action-Zuständen im Betrieb
Zielgruppe
Geeignet für Entwickler, Data Engineers und Betriebsverantwortliche, die wiederkehrende Batch- und Datenpipelines mit Oozie planen oder warten.
Fachbereichsleitung / Leitung der Trainer / Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, 2. Tag: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Entwickler, Data Engineers, BI-Teams und Betreiber zeitgesteuerter Datenverarbeitung |
| Voraussetzungen: | Sichere Grundlagen in Linux, Hadoop-Grundbegriffen, HDFS und XML. Erfahrung mit Skripten oder Datenverarbeitung erleichtert die Übungen. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
