Perfilado de sección

  • Especialización práctica na que os profesionais aprenderán a orquestrar pipelines de datos usando ecosistemas distribuídos baseados en Apache Spark (PySpark) mediante contornas Jupyter.

    Obxectivos :

    1. Comprender a computación distribuída.
    2. Desenvolver fluxos ETL en PySpark.
    3. Limpar e transformar dataframes territoriais.