Entrar em Contato

Programa do Curso

Introdução:

  • Apache Spark no Ecossistema Hadoop
  • Introdução breve a Python e Scala

Básico (teoria):

  • Arquitetura
  • RDD
  • Transformações e Ações
  • Fase, Tarefa, Dependências

Usando o ambiente Databricks para compreender o básico (workshop prático):

  • Exercícios usando a API RDD
  • Funções básicas de ação e transformação
  • PairRDD
  • Join
  • Estratégias de cache
  • Exercícios usando a API DataFrame
  • SparkSQL
  • DataFrame: select, filter, group, sort
  • UDF (Função Definida pelo Usuário)
  • Explorando a API DataSet
  • Streaming

Usando o ambiente AWS para compreender a implantação (workshop prático):

  • Básico do AWS Glue
  • Compreensão das diferenças entre AWS EMR e AWS Glue
  • Exemplos de jobs em ambos os ambientes
  • Entendimento dos prós e contras

Bônus:

  • Introdução à orquestração com Apache Airflow

Requisitos

Conhecimentos de programação (preferencialmente Python e Scala)

Conceitos básicos de SQL

 21 Horas

Número de participantes


Preço por participante

Testemunhos de Clientes (3)

Próximas Formações Provisórias

Categorias Relacionadas