Zum Inhalt springen
Schulung · NE-AWSBBDAS

Building Batch Data Analytics Solutions on AWS

Entwickle skalierbare Batch-Analytics-Pipelines mit Amazon EMR, Spark, Glue und Lake Formation

  • Batch-Analytics mit Amazon EMR
  • Spark- und Hadoop-Workloads
  • Datenaufnahme und Speicherung
  • 1 Tag
  • Fortgeschritten
  • Online
Building Batch Data Analytics Solutions on AWS
  • Zufriedenheitsgarantie Risikofrei für dich
  • Online Live per Videokonferenz
  • max. 8 Teilnehmerinnen und Teilnehmer pro Gruppe
  • Keine Vorkasse Rechnung nach dem Seminar
Ergebnis

Das nimmst du mit

  • Batch-Analytics mit Amazon EMR
  • Spark- und Hadoop-Workloads
  • Datenaufnahme und Speicherung
  • Performance- und Kostenoptimierung
  • Sicherheit und Monitoring
Für wen

Passt das zu dir?

Damit du den Tag wirklich mitnimmst, lohnt sich ein kurzer Abgleich.

Richtig für dich, wenn

  • Datenplattform-Ingenieurinnen und Datenplattform-Ingenieure, die Batch-Analytics-Pipelines auf AWS entwickeln oder betreiben
  • Data Engineers und Data Architects mit Verantwortung für Spark-, Hadoop- oder EMR-Workloads
  • Entwicklerinnen, Entwickler und Cloud-Operations-Teams, die Datenaufnahme, Transformation und Speicherung automatisieren
  • Analytics-Teams, die bestehende On-Premises-Big-Data-Workloads auf AWS übertragen oder erweitern

Das bringst du mit

  • Mindestens ein Jahr Erfahrung in der Verwaltung von Open-Source-Data-Frameworks wie Apache Spark oder Apache Hadoop
  • Grundverständnis von AWS-Services, IAM, Netzwerkgrundlagen und Cloud-Speicher
  • Empfohlen: vorherige Teilnahme an AWS Technical Essentials oder Architecting on AWS
  • Empfohlen: Grundlagenwissen zu Data Lakes, ETL-Prozessen und analytischen Datenmodellen
Ablauf

Dein Lernweg

  1. Vormittag: Datenanalyse, Amazon EMR und Datenaufnahme

    • Einordnung von Batch-Analytics in moderne Datenarchitekturen
    • Überblick über Data Pipelines, Data Lakes und analytische Workloads
    • Architektur und Einsatzszenarien von Amazon EMR
    • Start und Konfiguration eines EMR-Clusters
    • Datenaufnahme, Speicherung und Optimierung von Speicherformaten
  2. Mittag: Spark, Hive und Batch-Verarbeitung

    • Verarbeitung von Daten mit Apache Spark auf Amazon EMR
    • Transformationen, Jobs und Performance-Aspekte in Spark
    • Nutzung von Notebooks für Datenanalysen
    • Batch-Verarbeitung mit Apache Hive
    • Einordnung von Apache HBase im EMR-Umfeld
  3. Nachmittag: Serverless, Sicherheit und Lösungsdesign

    • Zusammenspiel von AWS Glue, Amazon EMR und AWS Step Functions
    • Sicherheitskonzepte für EMR-Cluster und Datenzugriffe
    • Verschlüsselung, Monitoring und Fehlerbehebung
    • Kosten- und Performance-Optimierung für Batch-Workloads
    • Entwurf einer Batch-Datenanalyselösung auf AWS
So läuft es ab

Klarheit von Anfang an

Format, Ablauf und alles, was schon enthalten ist. Keine Überraschungen, nur Fokus auf dein Ergebnis.

Format
  • Live-OnlineInteraktiv per Videokonferenz, von überall
Zeiten
  • Montag09:00 bis 17:00 Uhr
Dauer

1 Tag

Kompakt aufgebaut, damit du schnell ins Tun kommst.

Gruppengröße

max. 8

Kleine Gruppe, damit genug Raum für deine Fragen bleibt.

Methodik
  • Trainergeführte Fachvorträge mit direktem Bezug zu AWS-Architekturen und Data-Engineering-Szenarien
  • Praktische Übungen und Demonstrationen mit Amazon EMR, Apache Spark und ergänzenden AWS-Diensten
  • Architekturbetrachtungen zu Datenaufnahme, Speicherung, Verarbeitung, Sicherheit und Kostensteuerung
  • Diskussion typischer Projektanforderungen aus Analytics-, Cloud- und Plattform-Teams
  • Praxisnaher Erfahrungsaustausch mit AWS-erfahrenen Trainerinnen und Trainern

Das ist immer dabei

  • Ausführliche Schulungsunterlagen und Praxisbeispiele
  • Teilnahmezertifikat
  • Übungsumgebungen und Beispieldaten
  • Nachbetreuung per E-Mail nach dem Seminar
04 Termine

Sichere dir deinen Platz

Wähle den Termin, der zu dir passt. Online live dabei oder vor Ort, ganz wie es für dich passt.

  • Erfahrene IT-Trainer aus der Praxis
  • Keine Vorkasse, Rechnung nach dem Seminar
  • Kostenfreie Umbuchung bis 14 Tage vor Start
Für Teams und Unternehmen

Lieber das ganze Team?

Bring dieses Seminar zu euch ins Haus oder lass uns ein Programm bauen, das genau auf euer Unternehmen passt.

Firmen-Seminar

Ein individuelles Programm, das wir auf eure Ziele zuschneiden.

  • Frei kombinierbare Module aus unserem Themenkatalog
  • Skalierbar von der Kleingruppe bis zur ganzen Belegschaft
  • Begleitung über mehrere Termine hinweg möglich
Persönlich für dich da

Deine IT-Schulungen München-Expertinnen und -Experten

Du hast Fragen zu Inhalten, Terminen oder einer passenden Lösung für dein Team? Wir beraten dich gern, bevor du buchst. Direkt, ohne Umwege.

Antwort in der Regel am selben Werktag

Dein cmt-Team München

Beratung zu IT-Weiterbildung

Fragen und Antworten zu Building Batch Data Analytics Solutions on AWS

Worum geht es in der Schulung Building Batch Data Analytics Solutions on AWS?

Die Schulung behandelt den Aufbau von Batch-Datenanalyselösungen auf AWS. Im Mittelpunkt stehen Amazon EMR, Apache Spark, Apache Hadoop, AWS Glue, AWS Lake Formation, Datenaufnahme, Speicherung, Verarbeitung, Sicherheit, Monitoring und Kostenoptimierung.

Für wen ist das AWS Batch Data Analytics Training geeignet?

Das Training richtet sich an Data Engineers, Datenplattform-Ingenieurinnen und Datenplattform-Ingenieure, Data Architects, Entwicklerinnen und Entwickler sowie Cloud-Operations-Teams, die analytische Datenpipelines mit Spark, Hadoop oder Amazon EMR entwickeln und betreiben.

Welche Vorkenntnisse sind für die Teilnahme sinnvoll?

Empfohlen wird mindestens ein Jahr Erfahrung mit Open-Source-Data-Frameworks wie Apache Spark oder Apache Hadoop. Zusätzlich helfen AWS-Grundlagen, etwa aus AWS Technical Essentials, um IAM, Storage, Netzwerk und grundlegende Cloud-Services sicher einzuordnen.

Bereitet der Kurs auf eine AWS-Zertifizierung vor?

Der Kurs vermittelt wichtige Praxisgrundlagen für Data Engineering und Analytics auf AWS, vergibt jedoch keine eigenständige Zertifizierung. Die frühere AWS Certified Data Analytics - Specialty Prüfung wird nicht mehr angeboten. Für aktuelle Zertifizierungspfade sollte die passende AWS-Rolle und Prüfungszielsetzung separat geprüft werden.

Was ist der Unterschied zu Building Data Lakes on AWS?

Building Data Lakes on AWS behandelt den Aufbau, die Absicherung und Governance von Data Lakes. Diese Schulung legt den Schwerpunkt auf Batch-Verarbeitung, Amazon EMR, Spark, Hadoop und die Umsetzung analytischer Verarbeitungspipelines.

Welche Rolle spielt Kostenoptimierung in der Schulung?

Kostenoptimierung wird anhand von Amazon EMR-Clustern, Instanztypen, Skalierung, Speicherformaten und Workload-Design behandelt. Für eine vertiefende Betrachtung von Cloud-Kosten und Governance passt ergänzend AWS Cloud Financial Management for Builders.

Bereit?

Bring dein Team mit Building Batch Data Analytics Solutions on AWS weiter

Wir beraten dich unverbindlich zur passenden Schulungsform: offenes Seminar, Inhouse oder individuell zugeschnitten.

Building Batch Data Analytics Solutions on AWS

Nächster Termin: 18. September 2026 · Online

ab795 €netto