Entrar em Contato

Programa do Curso

Introdução

  • Noção geral das funcionalidades e arquitetura do Spark e do Hadoop
  • Compreensão do conceito de big data
  • Fundamentos da programação Python

Iniciando o Uso

  • Configuração do Python, Spark e Hadoop
  • Compreensão das estruturas de dados em Python
  • Compreensão da API PySpark
  • Conceitos de HDFS e MapReduce

Integração do Spark e Hadoop com Python

  • Implementação de RDDs do Spark em Python
  • Processamento de dados usando MapReduce
  • Criação de conjuntos de dados distribuídos no HDFS

Aprendizado de Máquina com Spark MLlib

Processamento de Big Data com Spark Streaming

Trabalho com Sistemas de Recomendação

Trabalho com Kafka, Sqoop, Kafka e Flume

Apache Mahout com Spark e Hadoop

Troubleshooting (Resolução de Problemas)

Resumo e Próximos Passos

Requisitos

  • Experiência com Spark e Hadoop
  • Experiência com programação Python

Público-alvo

  • Cientistas de dados
  • Desenvolvedores
 21 Horas

Número de participantes


Preço por participante

Testemunhos de Clientes (3)

Próximas Formações Provisórias

Categorias Relacionadas