Este curso capacita você a construir sistemas robustos e escaláveis para processamento de Big Data. Aprenda a dominar o Apache Spark para transformar e analisar grandes volumes de dados, impulsionando a tomada de decisões inteligentes na sua organização.
Nível: Iniciante a Intermediário
Para quem é: Desenvolvedores, cientistas de dados, analistas de BI e profissionais de TI que buscam especialização em processamento de Big Data.
Ao concluir, você será capaz de: Ao final do curso, o aluno será capaz de projetar, implementar e otimizar pipelines de dados em larga escala usando Apache Spark.
7 módulos · 10h · certificado ao final
- Introduzindo a Engenharia de Dados e o Ecossistema Apache Spark
- Configurando Ambientes Spark e Dominando DataFrames para Processamento
- Processando Dados em Larga Escala com Spark SQL e APIs
- Otimizando Performance e Gerenciando Recursos em Aplicações Spark
- Integrando Spark com Diversas Fontes de Dados e Armazenamento Distribuído
- Construindo Pipelines de Streaming com Spark Structured Streaming
- Projeto Final: Desenvolvendo um Pipeline Completo de Engenharia de Dados com Spark
Projeto Final
Implementação de um pipeline completo de ETL para ingestão, transformação e análise de um dataset de Big Data usando Spark, com saída para um formato otimizado e visualização básica.
