Vamos continuar a Exploratory Data Analysis - EDA, ou, nossa análise exploratória de dados utilizando a ferramenta Apache Spark em big data. Vamos explorar todas as suas funcionalidades capazes de lidar com essa importante fase do pipeline da Ciência de Dados.
Repositório para os notebooks:
https://github.com/rianbl/datarvw_spark
Documentação do Apache Spark:
https://spark.apache.org/