1. Export für Big-Data-Pipeline
DatenanalystHintergrund
Ein Datenanalyst muss monatliche Umsatzdaten aus einer Excel-Datei in eine Spark-Datenpipeline für Echtzeitanalysen integrieren.
Aufgabe
Excel-Dateien sind nicht optimiert für die Verarbeitung in verteilten Systemen und verlangsamen die Pipeline.
Verwendung
Laden Sie die Datei 'umsatz_2024.xlsx' hoch, wählen Sie 'Parquet + NDJSON' als Ausgabeformat und lassen Sie die Datentypen automatisch ableiten.
outputMode: bothErgebnis
Erhält eine ZIP-Datei mit Parquet- und NDJSON-Dateien, die direkt in die Spark-Pipeline eingefügt und effizient verarbeitet werden können.