Sobre este cursoIniciante a Intermediário · 7 módulos · 10h
Este curso capacita você a construir sistemas robustos e escaláveis para processamento de Big Data. Aprenda a dominar o Apache Spark para transformar e analisar grandes volumes de dados, impulsionando a tomada de decisões inteligentes na sua organização.
Nível: Iniciante a Intermediário
Para quem é: Desenvolvedores, cientistas de dados, analistas de BI e profissionais de TI que buscam especialização em processamento de Big Data.
Ao concluir, você será capaz de: Ao final do curso, o aluno será capaz de projetar, implementar e otimizar pipelines de dados em larga escala usando Apache Spark.
7 módulos · 10h · certificado ao final
- Introduzindo a Engenharia de Dados e o Ecossistema Apache Spark
- Configurando Ambientes Spark e Dominando DataFrames para Processamento
- Processando Dados em Larga Escala com Spark SQL e APIs
- Otimizando Performance e Gerenciando Recursos em Aplicações Spark
- Integrando Spark com Diversas Fontes de Dados e Armazenamento Distribuído
- Construindo Pipelines de Streaming com Spark Structured Streaming
- Projeto Final: Desenvolvendo um Pipeline Completo de Engenharia de Dados com Spark
Projeto Final
Implementação de um pipeline completo de ETL para ingestão, transformação e análise de um dataset de Big Data usando Spark, com saída para um formato otimizado e visualização básica.
Bem-vindo ao curso de Big Data com Spark: Construindo Pipelines Escaláveis.
Vou adaptar os exemplos ao que você gosta e fazer perguntas no final de cada módulo para garantir que tudo ficou claro.
Módulo 1: Introduzindo a Engenharia de Dados e o...
