Curso de Migrando Aplicações CUDA para Arquiteturas de GPU Chinesas
As arquiteturas de GPU chinesas, como Huawei Ascend, Biren e Cambricon MLUs, oferecem alternativas ao CUDA adaptadas para os mercados locais de IA e HPC.
Este treinamento ministrado por instrutores (online ou presencial) é voltado para programadores de GPUs de nível avançado e especialistas em infraestrutura que desejam migrar e otimizar aplicações CUDA existentes para implantação em plataformas de hardware chinesas.
Ao final deste treinamento, os participantes serão capazes de:
- Availiar a compatibilidade das cargas de trabalho CUDA existentes com alternativas de chips chineses.
- Portar bases de código CUDA para os ambientes Huawei CANN, Biren SDK e Cambricon BANGPy.
- Comparar o desempenho e identificar pontos de otimização entre as plataformas.
- Abrir desafios práticos no suporte e na implantação entre arquiteturas diferentes.
Formato do Curso
- Palestra interativa e discussão.
- Trilhas práticas de tradução de código e comparação de desempenho.
- Exercícios guiados focados em estratégias de adaptação multi-GPU.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso com base na sua plataforma ou projeto CUDA, entre em contato conosco para agendar.
Programa do Curso
Visão Geral do Ecossistema de GPU para IA Chinês
- Comparação entre Huawei Ascend, Biren e Cambricon MLU
- Modelos CUDA vs. CANN, Biren SDK e BANGPy
- Tendências industriais e ecossistemas de fornecedores
Preparação para a Migração
- Avaliação da sua base de código CUDA
- Identificação das plataformas-alvo e versões do SDK
- Instalação da toolchain e configuração do ambiente
Técnicas de Tradução de Código
- Portar o acesso à memória CUDA e a lógica dos núcleos (kernels)
- Mapeamento dos modelos de grade de computação / threads
- Opções de tradução automática versus manual
Implementações Específicas da Plataforma
- Uso de operadores e núcleos personalizados do Huawei CANN
- Pipeline de conversão do Biren SDK
- Reconstrução de modelos com o BANGPy (Cambricon)
Teste e Otimização entre Plataformas
- Profile da execução em cada plataforma-alvo
- Afinamento da memória e comparações de execução paralela
- Acompanhamento do desempenho e iteração
Gestão de Ambientes Mistas de GPU
- Implantações híbridas com múltiplas arquiteturas
- Estratégias de fallback e detecção de dispositivos
- Camadas de abstração para a manutenibilidade do código
Cases de Estudo e Melhores Práticas
- Portar modelos de visão computacional / PLN para Ascend ou Cambricon
- Implementar pipelines de inferência em clusters Biren
- Lidar com incompatibilidades de versão e lacunas de API
Resumo e Próximos Passos
Requisitos
- Experiência em programação com CUDA ou aplicações baseadas em GPU
- Compreensão dos modelos de memória da GPU e núcleos de computação (compute kernels)
- Familiaridade com fluxos de trabalho de implantação ou aceleração de modelos de IA
Público-Alvo
- Programadores de GPUs
- Arquitetos de sistemas
- Especialistas em portabilidade
Os cursos de treinamento abertos exigem mais de 5 participantes.
Curso de Migrando Aplicações CUDA para Arquiteturas de GPU Chinesas - Reserva
Curso de Migrando Aplicações CUDA para Arquiteturas de GPU Chinesas - Consulta
Migrando Aplicações CUDA para Arquiteturas de GPU Chinesas - SOLICITAÇÃO DE CONSULTORIA
Próximas Formações Provisórias
Cursos Relacionados
Desenvolvimento de Aplicações de IA com Huawei Ascend e CANN
21 HorasO Huawei Ascend é uma família de processadores de IA projetados para inferência e treinamento de alto desempenho.
Esta formação conduzida por instrutor (online ou presencial) direciona-se a engenheiros de IA e cientistas de dados de nível intermediário que desejam desenvolver e otimizar modelos de redes neurais utilizando a plataforma Ascend da Huawei e o toolkit CANN.
No final desta formação, os participantes serão capazes de:
- Configurar e preparar o ambiente de desenvolvimento do CANN.
- Desenvolver aplicações de IA utilizando fluxos de trabalho do MindSpore e CloudMatrix.
- Otimizar o desempenho em NPUs Ascend usando operadores personalizados e tiling (divisão em tiles).
- Implantar modelos em ambientes de borda ou nuvem.
Formato do Curso
- Palestra interativa e discussão.
- Uso prático do Huawei Ascend e do toolkit CANN em aplicações de exemplo.
- Exercícios orientados focados na construção, treinamento e implantação de modelos.
Opções de Personalização do Curso
- Para solicitar uma formação personalizada para este curso com base na sua infraestrutura ou conjuntos de dados, entre em contato conosco para organizar.
Implantação de Modelos de IA com CANN e Processadores AI Ascend
14 HorasO CANN (Compute Architecture for Neural Networks) é a pilha de computação para IA da Huawei, destinada à implantação e otimização de modelos de IA em processadores AI Ascend.
Este treinamento ao vivo com instrutor (online ou presencial) é voltado para desenvolvedores e engenheiros de IA de nível intermediário que desejam implantar modelos de IA treinados de forma eficiente no hardware Huawei Ascend, utilizando a caixa de ferramentas CANN e ferramentas como MindSpore, TensorFlow ou PyTorch.
Ao final deste treinamento, os participantes serão capazes de:
- Compreender a arquitetura do CANN e seu papel no pipeline de implantação de IA.
- Converter e adaptar modelos de frameworks populares para formatos compatíveis com Ascend.
- Utilizar ferramentas como ATC, conversão de modelos OM e MindSpore para inferência em borda e nuvem.
- Diagnosticar problemas de implantação e otimizar o desempenho no hardware Ascend.
Formato do Curso
- Palestra interativa e demonstração prática.
- Exercícios laboratoriais hands-on utilizando ferramentas CANN e simuladores ou dispositivos Ascend.
- Cenários práticos de implantação baseados em modelos de IA do mundo real.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
Inferência e Implantação de IA com CloudMatrix
21 HorasA CloudMatrix é a plataforma unificada de desenvolvimento e implantação de IA da Huawei, projetada para suportar pipelines de inferência escaláveis e prontos para produção.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), é destinado a profissionais de IA de nível iniciante a intermediário que desejam implantar e monitorar modelos de IA utilizando a plataforma CloudMatrix com integração CANN e MindSpore.
Ao final deste treinamento, os participantes serão capazes de:
- Utilizar a CloudMatrix para empacotamento, implantação e prestação de serviços de modelos.
- Converter e otimizar modelos para conjuntos de chips Ascend.
- Configurar pipelines para tarefas de inferência em tempo real e em lote.
- Monitorar implantações e ajustar o desempenho em ambientes de produção.
Formato do Curso
- Aulas interativas e discussões.
- Prática hands-on com a CloudMatrix em cenários reais de implantação.
- Exercícios guiados focados em conversão, otimização e escalabilidade.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso com base na sua infraestrutura de IA ou ambiente em nuvem, entre em contato conosco para organizar.
Programação de GPU em Aceleradores Biren
21 HorasOs aceleradores de IA Biren são GPUs de alto desempenho projetadas para cargas de trabalho de IA e HPC, com suporte para treinamento e inferência em larga escala.
Este treinamento ao vivo e ministrado por instrutor (online ou presencial) é destinado a desenvolvedores de nível intermediário a avançado que desejam programar e otimizar aplicações usando a pilha proprietária de GPU da Biren, com comparações práticas em relação a ambientes baseados em CUDA.
Ao final deste treinamento, os participantes serão capazes de:
- Compreender a arquitetura e a hierarquia de memória das GPUs Biren.
- Configurar o ambiente de desenvolvimento e usar o modelo de programação da Biren.
- Traduzir e otimizar código estilo CUDA para plataformas Biren.
- Aplicar técnicas de ajuste de desempenho e depuração.
Formato do Curso
- Palestra interativa e discussão.
- Uso prático do SDK da Biren em cargas de trabalho de GPU de exemplo.
- Exercícios orientados focados na portabilidade e ajuste de desempenho.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso com base na sua pilha de aplicativos ou necessidades de integração, entre em contato conosco para agendar.
Desenvolvimento de MLU da Cambricon com BANGPy e Neuware
21 HorasAs MLUs (Unidades de Processamento para Aprendizado de Máquina) da Cambricon são chips de IA especializados, otimizados para inferência e treinamento em cenários de borda (edge) e datacenters.
Este treinamento instruído por um especialista (online ou presencial) destina-se a desenvolvedores de nível intermediário que desejam criar e implantar modelos de IA utilizando o framework BANGPy e o SDK Neuware em hardware MLU da Cambricon.
Ao final deste treinamento, os participantes serão capazes de:
- Configurar e preparar os ambientes de desenvolvimento do BANGPy e do Neuware.
- Desenvolver e otimizar modelos baseados em Python e C++ para MLUs da Cambricon.
- Implantar modelos em dispositivos de borda e datacenters que executam o tempo de execução (runtime) do Neuware.
- Integrar fluxos de trabalho de ML com recursos específicos de aceleração do MLU.
Formato do Curso
- Aula interativa e discussão.
- Prática hands-on com BANGPy e Neuware para desenvolvimento e implantação.
- Exercícios guiados focados em otimização, integração e testes.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso baseado no seu modelo de dispositivo Cambricon ou caso de uso, entre em contato conosco para providenciarmos.
Introdução ao CANN para Desenvolvedores de Frameworks de IA
7 HorasO CANN (Compute Architecture for Neural Networks) é o toolkit de computação de IA da Huawei, utilizado para compilar, otimizar e implantar modelos de IA em processadores AI Ascend.
Esta formação presencial com instrutor (online ou no local) destina-se a desenvolvedores de IA iniciantes que desejam compreender como o CANN se encaixa no ciclo de vida do modelo, desde o treinamento até à implementação, e como funciona em conjunto com frameworks como MindSpore, TensorFlow e PyTorch.
Ao final desta formação, os participantes serão capazes de:
- Compreender o propósito e a arquitetura do toolkit CANN.
- Configurar um ambiente de desenvolvimento com CANN e MindSpore.
- Converter e implantar um modelo de IA simples em hardware Ascend.
- Adquirir conhecimentos fundamentais para futuros projetos de otimização ou integração do CANN.
Formato do Curso
- Palestra interativa e discussão.
- Laboratórios práticos com implantação de modelos simples.
- Percorrendo passo a passo a cadeia de ferramentas CANN e os pontos de integração.
Opções de Personalização do Curso
- Para solicitar uma formação personalizada para este curso, entre em contato conosco para agendar.
CANN para Implantação de IA na Borda
14 HorasA toolkit Ascend CANN da Huawei permite inferência poderosa de IA em dispositivos de borda, como o Ascend 310. O CANN fornece ferramentas essenciais para compilar, otimizar e implantar modelos em ambientes com recursos de processamento e memória limitados.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), é voltado para desenvolvedores de IA e integradores de nível intermediário que desejam implantar e otimizar modelos em dispositivos de borda Ascend utilizando a toolchain CANN.
Ao final deste treinamento, os participantes serão capazes de:
- Preparar e converter modelos de IA para o Ascend 310 usando as ferramentas do CANN.
- Construir pipelines de inferência leves utilizando MindSpore Lite e AscendCL.
- Otimizar o desempenho dos modelos para ambientes com recursos limitados de processamento e memória.
- Implantar e monitorar aplicações de IA em casos de uso reais na borda.
Formato do Curso
- Palestra interativa e demonstração prática.
- Exercícios práticos com modelos e cenários específicos para a borda.
- Exemplos de implantação ao vivo em hardware de borda virtual ou físico.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
Compreendendo o Stack de Computação em IA da Huawei: De CANN a MindSpore
14 HorasO stack de IA da Huawei — desde o SDK de baixo nível CANN até o framework de alto nível MindSpore — oferece um ambiente integrado de desenvolvimento e implementação de IA, otimizado para hardware Ascend.
Este treinamento instruído por especialista, realizado ao vivo (online ou presencial), destina-se a profissionais técnicos de nível iniciante a intermediário que desejam compreender como os componentes CANN e MindSpore trabalham juntos para apoiar o gerenciamento do ciclo de vida da IA e as decisões de infraestrutura.
Ao final deste treinamento, os participantes serão capazes de:
- Compreender a arquitetura em camadas do stack de computação em IA da Huawei.
- Identificar como o CANN suporta a otimização de modelos e a implementação em nível de hardware.
- Avaliar o framework MindSpore e seu conjunto de ferramentas em relação a alternativas do setor.
- Posicionar o stack de IA da Huawei dentro de ambientes empresariais ou de nuvem/on-premise.
Formato do Curso
- Palestra interativa e discussões.
- Demonstrações ao vivo do sistema e tutoriais baseados em casos práticos.
- Laboratórios guiados opcionais sobre o fluxo de modelos, desde o MindSpore até o CANN.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar os detalhes.
Otimização do Desempenho de Redes Neurais com o SDK CANN
14 HorasO SDK CANN (Compute Architecture for Neural Networks) é a base de computação para IA da Huawei, permitindo que desenvolvedores ajustem e otimizem o desempenho de redes neurais implantadas nos processadores de IA Ascend.
Esta treinamento orientado por instrutor, disponível online ou presencial, destina-se a desenvolvedores de IA de nível avançado e engenheiros de sistemas que desejam otimizar o desempenho de inferência utilizando o conjunto de ferramentas avançado do CANN, incluindo o Graph Engine, TIK e desenvolvimento de operadores personalizados.
Ao final deste treinamento, os participantes serão capazes de:
- Compreender a arquitetura de tempo de execução e o ciclo de vida de desempenho do CANN.
- Utilizar ferramentas de profiling e o Graph Engine para análise e otimização de desempenho.
- Criar e otimizar operadores personalizados usando TIK e TVM.
- Resolver gargalos de memória e melhorar a taxa de transferência dos modelos.
Formato do Curso
- Aula interativa e discussões.
- Laboratórios práticos com profiling em tempo real e ajuste de operadores.
- Exercícios de otimização utilizando exemplos de implantação com casos extremos (edge-case).
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
SDK CANN para Pipelines de Visão Computacional e PLN
14 HorasO SDK CANN (Compute Architecture for Neural Networks) oferece ferramentas poderosas de implantação e otimização para aplicações de IA em tempo real, especialmente em hardware Huawei Ascend.
Este treinamento ao vivo com instrutor (online ou presencial) é voltado para profissionais intermediários de IA que desejam construir, implantar e otimizar modelos de visão e linguagem para casos de uso em produção com o SDK CANN.
Ao final deste treinamento, os participantes serão capazes de:
- Implantar e otimizar modelos de VC e PLN usando CANN e AscendCL.
- Utilizar ferramentas do CANN para converter modelos e integrá-los a pipelines em tempo real.
- Otimizar o desempenho de inferência para tarefas como detecção, classificação e análise de sentimentos.
- Construir pipelines VC/PLN em tempo real para cenários de implantação na borda ou em nuvem.
Formato do Curso
- Palestra interativa e demonstração.
- Laboratório prático com implantação de modelos e perfilamento de desempenho.
- Projeto de pipeline ao vivo utilizando casos reais de VC e PLN.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para agendar.
Construção de Operadores Personalizados de IA com CANN TIK e TVM
14 HorasO CANN TIK (Tensor Instruction Kernel) e o Apache TVM permitem otimizações avançadas e personalização dos operadores de modelos de IA para hardware Huawei Ascend.
Este treinamento ao vivo, ministrado por instrutores (online ou presencial), destina-se a desenvolvedores de sistemas de nível avançado que desejam criar, implantar e ajustar operadores personalizados para modelos de IA, utilizando o modelo de programação TIK do CANN e a integração do compilador TVM.
Ao final deste treinamento, os participantes serão capazes de:
- Escrever e testar operadores personalizados de IA usando o DSL TIK para processadores Ascend.
- Integrar ops personalizados no tempo de execução do CANN e no grafo de execução.
- Utilizar o TVM para escalonamento de operadores, ajuste automático e benchmarking.
- Depurar e otimizar o desempenho em nível de instruções para padrões de computação personalizados.
Formato do Curso
- Palestra interativa e demonstrações práticas.
- Codificação prática de operadores utilizando os pipelines TIK e TVM.
- Testes e ajustes no hardware Ascend ou em simuladores.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar os detalhes.
Otimização de Performance na Ascend, Biren e Cambricon
21 HorasA Ascend, a Biren e a Cambricon são plataformas líderes de hardware de IA na China, oferecendo cada uma ferramentas únicas de aceleração e perfilamento para cargas de trabalho de IA em escala de produção.
Este treinamento ao vivo com instrutor (online ou presencial) é destinado a engenheiros avançados de infraestrutura de IA e performance que desejam otimizar fluxos de trabalho de inferência e treinamento de modelos em múltiplas plataformas de chips de IA chineses.
Ao final deste treinamento, os participantes serão capazes de:
- Realizar benchmarking de modelos nas plataformas Ascend, Biren e Cambricon.
- Identificar gargalos do sistema e ineficiências de memória/cálculo.
- Aplicar otimizações em nível de grafo, kernel e operador.
- Afinar pipelines de implantação para melhorar a taxa de transferência e a latência.
Formato do Curso
- Aulas interativas e discussões.
- Uso prático das ferramentas de perfilamento e otimização em cada plataforma.
- Exercícios guiados focados em cenários práticos de afinação.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso com base no seu ambiente de performance ou tipo de modelo, entre em contato conosco para organizar.