Ao selecionar um país você vê os cursos disponíveis na sua região.
⏱ 2 h 42 min📚 27 aulas🎧 Versão em áudio
Fundamentos de Big Data com Python e PySpark
Este curso ensina aos iniciantes as habilidades essenciais para processar e analisar conjuntos de dados em grande escala de forma eficiente usando Python e o framework Apache Spark.
💬Instrutor de IA Pergunte sobre qualquer aula e receba uma resposta clara na hora, quando quiser.
🕐Comece quando quiser Sem horários nem prazos: aprenda no seu ritmo, quando quiser.
🌐Em português Aulas, tarefas e certificado: tudo totalmente no seu idioma.
Sobre este curso
Big Data requer ferramentas especializadas para lidar com grandes volumes de informações que o software padrão não consegue gerenciar. PySpark fornece o link crucial entre as ferramentas familiares de ciência de dados Python e o poder da computação distribuída.
No final deste curso, você será proficiente na configuração de um ambiente de processamento de dados, manipulando grandes conjuntos de dados usando as bibliotecas de análise de dados do Python e aplicando o PySpark para executar transformações escaláveis, análises e tarefas básicas de aprendizado de máquina em clusters distribuídos.
O que você vai aprender:
* Entenda os conceitos fundamentais de computação distribuída e a arquitetura Apache Spark.
* Domine as estruturas de dados Python e utilize a biblioteca pandas para uma manipulação eficiente de dados locais.
* Aplique PySpark DataFrames e Spark SQL para ler, limpar e transformar conjuntos de dados estruturados maciços.
* Configurar ambientes virtuais básicos e gerenciar dependências para projetos de ciência de dados escaláveis.
* Pratique transformações de dados comuns, agregações, junções e técnicas de otimização de consultas no PySpark.
* Aprenda a realizar ingestão de dados de streaming básicos e aplicar modelos de aprendizado de máquina usando MLlib.
O curso começa com uma base sólida no manuseio de dados Python e configuração do ambiente antes de introduzir os conceitos básicos de processamento distribuído. Em seguida, passamos à aplicação prática usando PySpark DataFrames, com foco na manipulação e análise de dados escaláveis, culminando em introduções às ferramentas de streaming e aprendizado de máquina.
Este curso é projetado para iniciantes interessados em engenharia de dados, ciência de dados ou análise de dados que precisam trabalhar com grandes conjuntos de dados. Não é necessária experiência prévia com o Spark ou sistemas distribuídos.
Comece a desenvolver sua experiência em processamento de dados escaláveis hoje mesmo.
O que você vai receber
📜Certificado de conclusão Adicione ao seu perfil do LinkedIn
💬Tutor AI pessoal Travou em uma aula? Pergunte ao seu tutor integrado qualquer coisa, a qualquer hora.
🎧Versão em áudio incluída Estude em qualquer lugar, sem tela
♾️Acesso vitalício Volte quando quiser, sem expirar
📱Celular ou computador Funciona em qualquer dispositivo
💸Reembolso em 14 dias Sem perguntas
⚡Curto e focado 2 h 42 min de conteúdo prático
Avaliações
Ainda não há avaliações — seja o primeiro a compartilhar sua experiência.
Perguntas frequentes
O que preciso para fazer este curso?+
Só um celular ou computador com internet. Sem instalações nem hardware especial.
Como faço para pagar?+
Com cartão via Stripe. Não guardamos dados do cartão — o Stripe processa com segurança.
Posso pedir reembolso?+
Sim — reembolso integral em 14 dias, sem perguntas.
Por quanto tempo terei acesso?+
Para sempre. Uma vez comprado, o curso é seu para revisar quando quiser.
Vou receber um certificado?+
Sim. Ao concluir, você recebe um certificado que pode adicionar ao seu perfil do LinkedIn.