6) Apache Spark e procesamento masivo territorial
Section outline
-
Especialización práctica na que os profesionais aprenderán a orquestrar pipelines de datos usando ecosistemas distribuídos baseados en Apache Spark (PySpark) mediante contornas Jupyter.
Obxectivos :
- Comprender a computación distribuída.
- Desenvolver fluxos ETL en PySpark.
- Limpar e transformar dataframes territoriais.