Programa do Curso
Introdução ao Apache Spark
- O papel do Spark no processamento de big data
- Arquitetura do Spark e seus componentes
Configurando o Apache Spark
- Requisitos de hardware e software
- Procedimentos de instalação para modos standalone e cluster
- Melhores práticas de configuração para administradores de sistemas
Administrando Clusters Spark
- Ferramentas e técnicas de gerenciamento de cluster
- Monitoramento de aplicativos Spark e recursos do cluster
- Configurações de segurança e gerenciamento de usuários
Ajuste de Desempenho e Otimização
- Alocação de recursos e agendamento
- Tuning do Spark para desempenho ótimo
- Identificação e resolução de gargalos comuns
Resolução de Problemas e Troubleshooting
- Desafios comuns de administração do Spark
- Ferramentas e técnicas de diagnóstico para troubleshooting
- Abordagem passo a passo para resolver problemas comuns
- Melhores práticas para manter um ambiente Spark saudável
Tópicos Avançados de Administração
- Integração com outras ferramentas de big data
- Garantir alta disponibilidade e recuperação de desastres
- Atualização e dimensionamento de clusters Spark
Resumo e Próximos Passos
Requisitos
- Conhecimento básico de configuração e gerenciamento de rede
- Familiaridade com o sistema operacional Linux e a interface de linha de comando
- Interesse em aprender sobre sistemas de computação distribuída e gerenciamento de big data
Público-Alvo
- Administradores de sistemas
Testemunhos de Clientes (3)
Uma jornada pelo mundo do Spark: um curso muito intenso. DSL, Spark SQL, particionamento vs. bucketização para mim.
Georgiana Elisabeta
Curso - Apache Spark Fundamentals
Máquina Traduzida
Gostei do fato de ser prático. Adorei aplicar o conhecimento teórico com exemplos práticos.
Aurelia-Adriana - Allianz Services Romania
Curso - Python and Spark for Big Data (PySpark)
Máquina Traduzida
O fato de podermos levar conosco a maior parte das informações/cursos/apresentações/exercícios realizados, para que possamos revisá-los e talvez refazê-los se não entendermos na primeira vez ou melhorar o que já fizemos.
Raul Mihail Rat - Accenture Industrial SS
Curso - Python, Spark, and Hadoop for Big Data
Máquina Traduzida