Engenharia de dados prática: crie pipelines com Spark, Kafka e Airflow — WalkSelf
⏱ 2 h 42 min 📚 27 aulas 🎧 Versão em áudio

Engenharia de dados prática: crie pipelines com Spark, Kafka e Airflow

Saiba como projetar, criar e automatizar pipelines de dados em lote e streaming robustos usando ferramentas padrão do setor, como PySpark, Kafka, Airflow e Docker.

  • 💬 Instrutor de IA
    Pergunte sobre qualquer aula e receba uma resposta clara na hora, quando quiser.
  • 🕐 Comece quando quiser
    Sem horários nem prazos: aprenda no seu ritmo, quando quiser.
  • 🌐 Em português
    Aulas, tarefas e certificado: tudo totalmente no seu idioma.

Sobre este curso

As empresas modernas geram grandes quantidades de dados diariamente, mas esses dados são inúteis sem pipelines robustos para processá-los, limpá-los e armazená-los.Este curso somente de texto orienta você através dos principais conceitos de engenharia de dados, levando você de dados brutos para pipelines prontos para produção. Você passará de um iniciante a um profissional confiante capaz de projetar e automatizar fluxos de trabalho de processamento em lote e fluxo.Através de explicações claras e práticas de código, você dominará as ferramentas fundamentais usadas pelas equipes de dados modernas. O que você aprenderá: Entenda a arquitetura fundamental das plataformas de dados e sistemas de armazenamento modernos; Construa pipelines ETL automatizados usando Airflow para agendar e monitorar fluxos de trabalho de dados; Processe conjuntos de datos em grande escala de forma eficiente usando PySpark e Pandas; Configure pipelines de dados de streaming em tempo real com Kafka para processamento instantâneo de dados Conteinerize seus aplicativos de dados usando o Docker para garantir ambientes consistentes; Limpe, analise e valide os dados recebidos para manter altos padrões de qualidade de dados.O curso começa com definições fundamentais de engenharia de dados, bancos de dados e containerização. Você progredirá passo a passo através do processamento em lote, processamento de fluxo e orquestração de pipeline usando cenários do mundo real. Este curso foi projetado para aspirantes a engenheiros de dados, desenvolvedores de software e analistas de dados com uma compreensão básica do Python. Comece a ler hoje para construir seu primeiro pipeline de dados confiável.

O que você vai receber

  • 📜 Certificado de conclusão
    Adicione ao seu perfil do LinkedIn
  • 💬 Tutor AI pessoal
    Travou em uma aula? Pergunte ao seu tutor integrado qualquer coisa, a qualquer hora.
  • 🎧 Versão em áudio incluída
    Estude em qualquer lugar, sem tela
  • ♾️ Acesso vitalício
    Volte quando quiser, sem expirar
  • 📱 Celular ou computador
    Funciona em qualquer dispositivo
  • 💸 Reembolso em 14 dias
    Sem perguntas
  • ⚡ Curto e focado
    2 h 42 min de conteúdo prático

Avaliações

Ainda não há avaliações — seja o primeiro a compartilhar sua experiência.

Escrever uma avaliação

☆☆☆☆☆
Pediremos para fazer login após enviar — o rascunho fica salvo.

Perguntas frequentes

O que preciso para fazer este curso? +

Só um celular ou computador com internet. Sem instalações nem hardware especial.

Como faço para pagar? +

Com cartão via Stripe. Não guardamos dados do cartão — o Stripe processa com segurança.

Posso pedir reembolso? +

Sim — reembolso integral em 14 dias, sem perguntas.

Por quanto tempo terei acesso? +

Para sempre. Uma vez comprado, o curso é seu para revisar quando quiser.

Vou receber um certificado? +

Sim. Ao concluir, você recebe um certificado que pode adicionar ao seu perfil do LinkedIn.

Feito para profissionais em
Tecnologia Design Finanças Marketing Saúde Educação Hotelaria Indústria