Entrar em Contato

Programa do Curso

Introdução:

  • Apache Spark no Ecossistema Hadoop
  • Introdução breve a Python e Scala

Fundamentos (teoria):

  • Arquitetura
  • RDD
  • Transformações e Ações
  • Stage, Task, Dependências

Entenda os fundamentos usando o ambiente Databricks (oficina prática):

  • Exercícios usando a API RDD
  • Funções básicas de ação e transformação
  • PairRDD
  • Join
  • Estratégias de cache
  • Exercícios usando a API DataFrame
  • SparkSQL
  • DataFrame: select, filter, group, sort
  • UDF (Função Definida pelo Usuário)
  • Visão sobre a API DataSet
  • Streaming

Entenda a implantação usando o ambiente AWS (oficina prática):

  • Fundamentos do AWS Glue
  • Entender as diferenças entre AWS EMR e AWS Glue
  • Exemplos de jobs em ambos os ambientes
  • Entender prós e contras

Extra:

  • Introdução à orquestração com Apache Airflow

Requisitos

Habilidades de programação (preferencialmente Python, Scala)

Conhecimentos básicos de SQL

 21 Horas

Treinamento Corporativo Personalizado

Soluções de treinamento projetadas exclusivamente para empresas.

  • Conteúdo Personalizado: Adaptamos o programa e os exercícios práticos aos objetivos e necessidades reais do seu projeto.
  • Horário Flexível: Datas e horários adaptados à agenda da sua equipe.
  • Formato: Online (ao vivo), In-Company (em suas instalações) ou Híbrido.
Investimento

Preço por grupo privado, treinamento online ao vivo, a partir de 3900 € + VAT*

Entre em contato conosco para obter um orçamento preciso e conhecer nossas promoções mais recentes

Testemunhos de Clientes (3)

Próximas Formações Provisórias

Categorias Relacionadas