Big Data com Spark: Construindo Pipelines Escaláveis

Este curso capacita você a construir sistemas robustos e escaláveis para processamento de Big Data. Aprenda a dominar o Apache Spark para transformar e analisar grandes volumes de dados, impulsionando a tomada de decisões inteligentes na sua organização.

Nível: Iniciante a Intermediário

Para quem é: Desenvolvedores, cientistas de dados, analistas de BI e profissionais de TI que buscam especialização em processamento de Big Data.

Ao concluir, você será capaz de: Ao final do curso, o aluno será capaz de projetar, implementar e otimizar pipelines de dados em larga escala usando Apache Spark.

7 módulos · 10h · certificado ao final

  • Introduzindo a Engenharia de Dados e o Ecossistema Apache Spark
  • Configurando Ambientes Spark e Dominando DataFrames para Processamento
  • Processando Dados em Larga Escala com Spark SQL e APIs
  • Otimizando Performance e Gerenciando Recursos em Aplicações Spark
  • Integrando Spark com Diversas Fontes de Dados e Armazenamento Distribuído
  • Construindo Pipelines de Streaming com Spark Structured Streaming
  • Projeto Final: Desenvolvendo um Pipeline Completo de Engenharia de Dados com Spark

Projeto Final

Implementação de um pipeline completo de ETL para ingestão, transformação e análise de um dataset de Big Data usando Spark, com saída para um formato otimizado e visualização básica.

🎓
Big Data com Spark: Construindo Pipelines Escaláveis 7 módulos · 10h · certificado
Módulo 1 de 7
Aula interativa · Tutor IA
Como quer estudar?
Bem-vindo à sua aula de Big Data com Spark: Construindo Pipelines Escaláveis! Eu sou seu Tutor IA e esta conversa é o próprio curso: cada mensagem faz parte da trilha, com explicações, exemplos, diagramas e desafios. Para começar, me diga seu nome e do que você gosta. Vou usar isso nos exemplos.