Insights práticos, exemplos reais e espaço para perguntas ao vivo. PARTICIPE DA LIVE GRATUITA

Jornada Apache Spark

Aprenda a construir pipelines distribuídos em Apache Spark, com DAGs, foco em performance e decisões arquiteturais aplicadas a ambientes de dados complexos.

84 horas Ao vivo
Jornada Apache Spark
Engenharia de Dados

Sobre a Jornada

A Jornada Apache Spark é uma formação completa para quem deseja dominar processamento de dados em escala. Você aprende desde os fundamentos, arquitetura, execução e performance do Spark. Ao longo da jornada, você desenvolve a capacidade de projetar e otimizar pipelines distribuídos para ambientes corporativos reais.

Cursos da Jornada

  • Módulo 01 O papel do Apache Spark em engenharia de dados
  • Módulo 02 Arquitetura e conceitos fundamentais do Spark
  • Módulo 03 Spark APIs e primeiros usos
  • Módulo 04 Transformações e ações básicas
  • Módulo 05 Boas práticas em Apache Spark
  • Módulo 01 DataFrames e transformações intermediárias
  • Módulo 02 Joins e combinações de dados em Spark
  • Módulo 03 Particionamento e controle de dados
  • Módulo 04 Integração com fontes de dados
  • Módulo 05 Operação e monitoramento básico
  • Módulo 01 Arquitetura avançada do Apache Spark
  • Módulo 02 Performance e tuning de aplicações Spark
  • Módulo 03 Análise de execução e debugging
  • Módulo 04 Spark em ambientes corporativos
  • Módulo 05 Papel do especialista em Spark

Confira tudo que voce vai dominar neste curso.

Investimento

84 horas para transformar seus dados em vantagem competitiva.

  • 84 horas de conteúdo
  • Certificado de conclusão
  • Roadmap pronto
  • Material didático com conteúdo completo
  • Aulas prontas disponíveis por 3 meses

Certificado

Certificado alinhado às práticas de mercado e às plataformas utilizadas por empresas.

Certificado

FAQs

Veja as perguntas mais frequentes. Se precisar de mais informações, entre em contato conosco.

As Jornadas são programas de imersão vertical focados no domínio completo de uma tecnologia ou plataforma específica (como dbt, Spark, Bigtable ou Vertex AI). Elas são estruturadas de forma progressiva, conectando os níveis Iniciante, Intermediário e Avançado. O objetivo é que você saia do zero e atinja a fluência técnica necessária para arquitetar soluções e resolver problemas complexos.

A diferença está na especificidade do seu objetivo. A Jornada é para quem busca especialização técnica imediata em uma stack (ex: "Quero ser um especialista em Apache Spark"). Já a Trilha é para quem busca formação profissional em uma carreira (ex: "Quero ser um Engenheiro de Dados"), onde você aprenderá não apenas uma, mas várias ferramentas que se complementam em um fluxo de trabalho completo.

Sim. Jornada é o formato indicado para quem já tem carreira consolidada e quer ir direto ao ponto, sem repetir uma formação de base. É o caminho mais ágil para fechar um gap técnico ou dominar um tema específico como FinOps em Nuvem, otimização de queries em escala ou MLOps.

A Rox School é o hub de formação em dados e inteligência artificial da Rox Partner, criado para desenvolver profissionais e empresas no desenvolvimento de uma cultura orientada por dados e na tomada de decisões mais estratégicas.

Para profissionais, as Jornadas podem ser adquiridas individualmente com acesso ao conteúdo estruturado através da plataforma de e-learning. Para empresas, oferecemos modelos personalizados, treinamentos in company e pacotes para capacitação de squads inteiras em stacks específicas.

Sim. Além das Jornadas padrão, podemos desenhar programas alinhados aos desafios específicos da sua organização, incluindo diagnósticos técnicos e masterclasses estratégicas.

Utilizamos um ambiente digital estruturado e seguro, com controle de acesso, autenticação em dois fatores e acompanhamento de desempenho, garantindo uma experiência confiável tanto para o aluno individual quanto para o ambiente corporativo.

Nossa plataforma oferece um ambiente de aprendizagem moderno onde as atividades são organizadas logicamente. Você terá acesso aos recursos, códigos-fonte e materiais de apoio das Jornadas, com acompanhamento de progresso para garantir que você conclua todos os níveis da tecnologia escolhida.

Entender como o Apache Spark funciona e seu papel no ecossistema de Big Data
Criar e executar transformações básicas em dados distribuídos com DataFrames
Construir pipelines distribuídos com joins, agregações e particionamento
Integrar o Spark a diferentes fontes de dados com foco em performance
Analisar planos de execução, DAGs e gargalos de performance
Tuning, otimização avançada e decisões arquiteturais em pipelines Spark
Profissionais de dados que querem trabalhar com grandes volumes de dados
Profissionais de dados e devs em transição para Engenharia de Dados
Data Engineers que desejam dominar Spark em profundidade
Usuários de Spark buscando evoluir em decisões técnicas e arquiteturais
Noções de programação em Python, Scala ou SQL
Conhecimento básico de dados tabulares
Noções de Big Data ou ambientes distribuídos
Ambiente próprio para executar Apache Spark (local ou cluster)
Experiência prévia com pipelines de dados (recomendado)