Building Batch Data Analytics Solutions on AWS
Entwickle skalierbare Batch-Analytics-Pipelines mit Amazon EMR, Spark, Glue und Lake Formation
- Batch-Analytics mit Amazon EMR
- Spark- und Hadoop-Workloads
- Datenaufnahme und Speicherung
- 1 Tag
- Fortgeschritten
- Online
- Zufriedenheitsgarantie Risikofrei für dich
- Online Live per Videokonferenz
- max. 8 Teilnehmerinnen und Teilnehmer pro Gruppe
- Keine Vorkasse Rechnung nach dem Seminar
Das nimmst du mit
- Batch-Analytics mit Amazon EMR
- Spark- und Hadoop-Workloads
- Datenaufnahme und Speicherung
- Performance- und Kostenoptimierung
- Sicherheit und Monitoring
Passt das zu dir?
Damit du den Tag wirklich mitnimmst, lohnt sich ein kurzer Abgleich.
Richtig für dich, wenn
- Datenplattform-Ingenieurinnen und Datenplattform-Ingenieure, die Batch-Analytics-Pipelines auf AWS entwickeln oder betreiben
- Data Engineers und Data Architects mit Verantwortung für Spark-, Hadoop- oder EMR-Workloads
- Entwicklerinnen, Entwickler und Cloud-Operations-Teams, die Datenaufnahme, Transformation und Speicherung automatisieren
- Analytics-Teams, die bestehende On-Premises-Big-Data-Workloads auf AWS übertragen oder erweitern
Das bringst du mit
- Mindestens ein Jahr Erfahrung in der Verwaltung von Open-Source-Data-Frameworks wie Apache Spark oder Apache Hadoop
- Grundverständnis von AWS-Services, IAM, Netzwerkgrundlagen und Cloud-Speicher
- Empfohlen: vorherige Teilnahme an AWS Technical Essentials oder Architecting on AWS
- Empfohlen: Grundlagenwissen zu Data Lakes, ETL-Prozessen und analytischen Datenmodellen
Dein Lernweg
Vormittag: Datenanalyse, Amazon EMR und Datenaufnahme
- Einordnung von Batch-Analytics in moderne Datenarchitekturen
- Überblick über Data Pipelines, Data Lakes und analytische Workloads
- Architektur und Einsatzszenarien von Amazon EMR
- Start und Konfiguration eines EMR-Clusters
- Datenaufnahme, Speicherung und Optimierung von Speicherformaten
Mittag: Spark, Hive und Batch-Verarbeitung
- Verarbeitung von Daten mit Apache Spark auf Amazon EMR
- Transformationen, Jobs und Performance-Aspekte in Spark
- Nutzung von Notebooks für Datenanalysen
- Batch-Verarbeitung mit Apache Hive
- Einordnung von Apache HBase im EMR-Umfeld
Nachmittag: Serverless, Sicherheit und Lösungsdesign
- Zusammenspiel von AWS Glue, Amazon EMR und AWS Step Functions
- Sicherheitskonzepte für EMR-Cluster und Datenzugriffe
- Verschlüsselung, Monitoring und Fehlerbehebung
- Kosten- und Performance-Optimierung für Batch-Workloads
- Entwurf einer Batch-Datenanalyselösung auf AWS
Klarheit von Anfang an
Format, Ablauf und alles, was schon enthalten ist. Keine Überraschungen, nur Fokus auf dein Ergebnis.
- Live-OnlineInteraktiv per Videokonferenz, von überall
- Montag09:00 bis 17:00 Uhr
1 Tag
Kompakt aufgebaut, damit du schnell ins Tun kommst.
max. 8
Kleine Gruppe, damit genug Raum für deine Fragen bleibt.
- Trainergeführte Fachvorträge mit direktem Bezug zu AWS-Architekturen und Data-Engineering-Szenarien
- Praktische Übungen und Demonstrationen mit Amazon EMR, Apache Spark und ergänzenden AWS-Diensten
- Architekturbetrachtungen zu Datenaufnahme, Speicherung, Verarbeitung, Sicherheit und Kostensteuerung
- Diskussion typischer Projektanforderungen aus Analytics-, Cloud- und Plattform-Teams
- Praxisnaher Erfahrungsaustausch mit AWS-erfahrenen Trainerinnen und Trainern
Das ist immer dabei
- Ausführliche Schulungsunterlagen und Praxisbeispiele
- Teilnahmezertifikat
- Übungsumgebungen und Beispieldaten
- Nachbetreuung per E-Mail nach dem Seminar
Sichere dir deinen Platz
Wähle den Termin, der zu dir passt. Online live dabei oder vor Ort, ganz wie es für dich passt.
- Erfahrene IT-Trainer aus der Praxis
- Keine Vorkasse, Rechnung nach dem Seminar
- Kostenfreie Umbuchung bis 14 Tage vor Start
Lieber das ganze Team?
Bring dieses Seminar zu euch ins Haus oder lass uns ein Programm bauen, das genau auf euer Unternehmen passt.
Inhouse-Schulung
Wir kommen zu dir und schulen dein Team genau auf eure Praxis.
- Komplett auf eure Use-Cases und Tools zugeschnitten
- Termin und Ort bestimmst du, vor Ort oder Live-Online
- Ein fester Pauschalpreis statt Preis pro Person
Firmen-Seminar
Ein individuelles Programm, das wir auf eure Ziele zuschneiden.
- Frei kombinierbare Module aus unserem Themenkatalog
- Skalierbar von der Kleingruppe bis zur ganzen Belegschaft
- Begleitung über mehrere Termine hinweg möglich
Deine IT-Schulungen München-Expertinnen und -Experten
Du hast Fragen zu Inhalten, Terminen oder einer passenden Lösung für dein Team? Wir beraten dich gern, bevor du buchst. Direkt, ohne Umwege.
Antwort in der Regel am selben Werktag
Dein cmt-Team München
Beratung zu IT-Weiterbildung
Fragen und Antworten zu Building Batch Data Analytics Solutions on AWS
Worum geht es in der Schulung Building Batch Data Analytics Solutions on AWS?
Die Schulung behandelt den Aufbau von Batch-Datenanalyselösungen auf AWS. Im Mittelpunkt stehen Amazon EMR, Apache Spark, Apache Hadoop, AWS Glue, AWS Lake Formation, Datenaufnahme, Speicherung, Verarbeitung, Sicherheit, Monitoring und Kostenoptimierung.
Für wen ist das AWS Batch Data Analytics Training geeignet?
Das Training richtet sich an Data Engineers, Datenplattform-Ingenieurinnen und Datenplattform-Ingenieure, Data Architects, Entwicklerinnen und Entwickler sowie Cloud-Operations-Teams, die analytische Datenpipelines mit Spark, Hadoop oder Amazon EMR entwickeln und betreiben.
Welche Vorkenntnisse sind für die Teilnahme sinnvoll?
Empfohlen wird mindestens ein Jahr Erfahrung mit Open-Source-Data-Frameworks wie Apache Spark oder Apache Hadoop. Zusätzlich helfen AWS-Grundlagen, etwa aus AWS Technical Essentials, um IAM, Storage, Netzwerk und grundlegende Cloud-Services sicher einzuordnen.
Bereitet der Kurs auf eine AWS-Zertifizierung vor?
Der Kurs vermittelt wichtige Praxisgrundlagen für Data Engineering und Analytics auf AWS, vergibt jedoch keine eigenständige Zertifizierung. Die frühere AWS Certified Data Analytics - Specialty Prüfung wird nicht mehr angeboten. Für aktuelle Zertifizierungspfade sollte die passende AWS-Rolle und Prüfungszielsetzung separat geprüft werden.
Was ist der Unterschied zu Building Data Lakes on AWS?
Building Data Lakes on AWS behandelt den Aufbau, die Absicherung und Governance von Data Lakes. Diese Schulung legt den Schwerpunkt auf Batch-Verarbeitung, Amazon EMR, Spark, Hadoop und die Umsetzung analytischer Verarbeitungspipelines.
Welche Rolle spielt Kostenoptimierung in der Schulung?
Kostenoptimierung wird anhand von Amazon EMR-Clustern, Instanztypen, Skalierung, Speicherformaten und Workload-Design behandelt. Für eine vertiefende Betrachtung von Cloud-Kosten und Governance passt ergänzend AWS Cloud Financial Management for Builders.
Passende Schulungen
Building Batch Data Analytics Solutions on AWS
Nächster Termin: 18. September 2026 · Online
ab795 €netto