Curso de Ollama: Modelos de Linguagem Grandes Auto-Hospedados que Substituem as APIs da OpenAI e Claude
O Ollama é uma ferramenta de código aberto para executar modelos de linguagem grandes localmente em hardware de consumo e empresarial. Ele abstrai a quantização de modelos, alocação de GPU e serviço de API em uma única interface de linha de comando, permitindo que as organizações auto-hospedem LLMs como Llama, Mistral e Qwen sem enviar prompts ou dados para a OpenAI, Anthropic ou Google.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), destina-se a engenheiros de IA e operadores de plataforma intermediários que desejam usar o Ollama para substituir as APIs de LLM em nuvem por inferência de modelo de linguagem auto-hospedada e soberana.
Ao final deste treinamento, os participantes serão capazes de:
- Instalar o Ollama no Linux, macOS e Windows com suporte a GPU.
- Baixar, quantizar e servir modelos do registro do Ollama e do HuggingFace.
- Criar Modelfiles personalizados com prompts de sistema e ajuste de parâmetros.
- Integrar LLMs locais com aplicativos por meio da API compatível com OpenAI.
- Otimizar o desempenho de inferência para configurações apenas em CPU e com múltiplas GPUs.
Formato do Curso
- Aula interativa e discussão.
- Muitos exercícios e prática.
- Implementação prática em um ambiente de laboratório ao vivo.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
Programa do Curso
Soberania de IA e Implantação Local de LLM
- Riscos dos LLMs em nuvem: retenção de dados, treinamento com base nas entradas, jurisdição estrangeira.
- Arquitetura do Ollama: servidor de modelos, registro e API compatível com OpenAI.
- Comparação com vLLM, llama.cpp e Text Generation Inference.
- Licenciamento de modelos: termos da Llama, Mistral, Qwen e Gemma.
Instalação e Configuração de Hardware
- Instalando o Ollama no Linux com suporte a CUDA e ROCm.
- Fallback apenas em CPU e otimização AVX/AVX2.
- Implantação via Docker e mapeamento de volumes persistentes.
- Configuração de múltiplas GPUs e estratégias de alocação de VRAM.
Gestão de Modelos
- Baixando modelos do registro do Ollama: ollama pull llama3.
- Importando modelos GGUF do HuggingFace e do TheBloke.
- Níveis de quantização: trocas entre Q4_K_M, Q5_K_M e Q8_0.
- Troca de modelos e limites de carregamento simultâneo de modelos.
Modelfiles Personalizados
- Escrita da sintaxe do Modelfile: FROM, PARAMETER, SYSTEM, TEMPLATE.
- Ajuste de temperatura, top_p e repeat_penalty.
- Engenharia de prompt de sistema para comportamento específico de papéis.
- Criação e publicação de modelos personalizados no registro local.
Integração de API
- Endpoint /v1/chat/completions compatível com OpenAI.
- Respostas em streaming e modo JSON.
- Integração com LangChain, LlamaIndex e aplicativos personalizados.
- Autenticação e limitação de taxa usando proxy reverso.
Otimização de Desempenho
- Tamanhos da janela de contexto e gerenciamento do cache KV.
- Inferência em lote e manipulação de solicitações paralelas.
- Alocação de threads na CPU e consciência NUMA.
- Monitoramento do uso da GPU e pressão na memória.
Segurança e Conformidade
- Isolamento de rede para endpoints de servidor de modelos.
- Filtragem de entradas e pipelines de moderação de saídas.
- Auditoria dos logs de prompts e conclusões.
- Procedência do modelo e verificação de hash.
Requisitos
- Administracao intermedia de Linux e contêineres.
- Compreensão de modelos de aprendizado de máquina e transformers em alto nível.
- Familiaridade com APIs REST e JSON.
Público-Alvo
- Engenheiros de IA e desenvolvedores que substituem APIs de LLM em nuvem.
- Organizações com sensibilidade de dados que impedem o uso de modelos em nuvem.
- Equipes governamentais e de defesa que exigem modelos de linguagem isolados da rede (air-gapped).
Os cursos de treinamento abertos exigem mais de 5 participantes.
Curso de Ollama: Modelos de Linguagem Grandes Auto-Hospedados que Substituem as APIs da OpenAI e Claude - Reserva
Curso de Ollama: Modelos de Linguagem Grandes Auto-Hospedados que Substituem as APIs da OpenAI e Claude - Consulta
Ollama: Modelos de Linguagem Grandes Auto-Hospedados que Substituem as APIs da OpenAI e Claude - SOLICITAÇÃO DE CONSULTORIA
Próximas Formações Provisórias
Cursos Relacionados
Depuração e Avaliação Avançadas de Modelos Ollama
35 HorasA Depuração e Avaliação Avançadas de Modelos Ollama é um curso aprofundado focado em diagnosticar, testar e medir o comportamento dos modelos ao executar implantações locais ou privadas do Ollama.
Este treinamento instruído por especialistas (online ou presencial) destina-se a engenheiros de IA avançados, profissionais de ML Ops e praticantes de QA que desejam garantir a confiabilidade, fidelidade e prontidão operacional dos modelos baseados em Ollama em produção.
Ao final deste treinamento, os participantes serão capazes de:
- Realizar depuração sistemática de modelos hospedados no Ollama e reproduzir modos de falha com confiabilidade.
- Projetar e executar pipelines de avaliação robustos com métricas quantitativas e qualitativas.
- Implementar observabilidade (logs, rastreamentos e métricas) para monitorar a saúde do modelo e o desvio de distribuição.
- Automatizar testes, validação e verificações de regressão integrados aos pipelines de CI/CD.
Formato do Curso
- Aula interativa e discussão.
- Laboratórios práticos e exercícios de depuração utilizando implantações do Ollama.
- Estudos de caso, sessões de resolução de problemas em grupo e workshops de automação.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
Criando Fluxos de Trabalho de IA Privados com Ollama
14 HorasEste treinamento guiado por instrutor, ministrado ao vivo em Brasil (online ou presencial), é direcionado a profissionais de nível avançado que desejam implementar fluxos de trabalho orientados por IA de forma segura e eficiente usando o Ollama.
Ao final deste treinamento, os participantes serão capazes de:
- Implantar e configurar o Ollama para processamento de IA privada.
- Integrar modelos de IA em fluxos de trabalho corporativos seguros.
- Otimizar o desempenho da IA mantendo a privacidade dos dados.
- Automatizar processos empresariais com capacidades de IA local.
- Garantir conformidade com as políticas corporativas de segurança e governança.
Implantando e Otimizando LLMs com Ollama
14 HorasEste treinamento ao vivo, ministrado por instrutor em Brasil (online ou presencial), é voltado para profissionais de nível intermediário que desejam implantar, otimizar e integrar LLMs usando o Ollama.
Ao final deste treinamento, os participantes serão capazes de:
- Configurar e implantar LLMs usando o Ollama.
- Otimizar modelos de IA para desempenho e eficiência.
- Aproveitar a aceleração por GPU para melhorar as velocidades de inferência.
- Integrar o Ollama em fluxos de trabalho e aplicações.
- Monitorar e manter o desempenho dos modelos de IA ao longo do tempo.
EXO: Implantação de Cluster Local de IA de Ponta a Ponta
21 HorasEste treinamento ao vivo, ministrado por instrutor em Brasil (online ou presencial), tem como público-alvo administradores de sistemas e engenheiros DevOps que desejam implantar, configurar e gerenciar clusters EXO para inferência privada de LLMs em vários nós com Apple Silicon ou Linux.
EXO para DevOps: Construindo uma Infraestrutura de IA Privada
21 HorasEsta formação presencial ao vivo em Brasil (online ou no local) é direcionada a engenheiros de DevOps e arquitetos de infraestrutura que desejam automatizar o provisionamento, monitoramento e gerenciamento do ciclo de vida de clusters privados de IA baseados no EXO.
Segurança e Governança do EXO: Gerenciamento de Modelos Offline
14 HorasEsta formação ao vivo, ministrada por instrutor em Brasil (online ou presencial), é direcionada a engenheiros de segurança e oficiais de conformidade que desejam endurecer as implantações do EXO, controlar o acesso aos modelos e governar as cargas de trabalho de IA executadas inteiramente no ambiente corporativo.
Ajuste Fino e Personalização de Modelos de IA no Ollama
14 HorasEste treinamento ao vivo, conduzido por instrutor em Brasil (online ou presencial), é voltado para profissionais de nível avançado que desejam realizar ajuste fino e personalização de modelos de IA no Ollama para obter desempenho aprimorado e aplicações específicas de domínio.
Ao final deste treinamento, os participantes serão capazes de:
- Configurar um ambiente eficiente para o ajuste fino de modelos de IA no Ollama.
- Preparar conjuntos de dados para ajuste fino supervisionado e aprendizado por reforço.
- Otimizar modelos de IA quanto a desempenho, precisão e eficiência.
- Implantar modelos personalizados em ambientes de produção.
- Avaliar as melhorias dos modelos e garantir sua robustez.
IA Agêntica Local Segura: Desenvolvimento com Ollama On-Premise para Setores Regulados
21 HorasEste treinamento ao vivo e ministrado por instrutor em Brasil (online ou presencial) destina-se a desenvolvedores e equipes técnicas que desejam usar o Ollama e modelos de código aberto para construir e executar soluções privadas de IA agênctica em infraestrutura interna.
Ao final deste treinamento, os participantes serão capazes de instalar e configurar o Ollama, avaliar e executar modelos locais, criar fluxos de trabalho agênticos e baseados em recuperação simples, e aplicar controles de segurança e governança para ambientes regulados.
Aplicações Multimodais com Ollama
21 HorasO Ollama é uma plataforma que permite executar e ajustar modelos de linguagem grande e multimodais localmente.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), destina-se a engenheiros de ML de nível avançado, pesquisadores de IA e desenvolvedores de produtos que desejam criar e implantar aplicativos multimodais com o Ollama.
Ao final deste treinamento, os participantes serão capazes de:
- Configurar e executar modelos multimodais com o Ollama.
- Integrar entradas de texto, imagem e áudio para aplicações do mundo real.
- Criar sistemas de entendimento de documentos e QA visual.
- Desenvolver agentes multimodais capazes de raciocínio entre modalidades.
Formato do Curso
- Palestra interativa e discussão.
- Prática com conjuntos de dados multimodais reais.
- Implementação em laboratório ao vivo de pipelines multimodais usando o Ollama.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
Iniciando com Ollama: Executando Modelos de IA Localmente
7 HorasEste treinamento ao vivo com instrutor em Brasil (online ou presencial) destina-se a profissionais de nível iniciante que desejam instalar, configurar e usar o Ollama para executar modelos de IA em suas máquinas locais.
Ao final deste treinamento, os participantes serão capazes de:
- Compreender os fundamentos do Ollama e suas capacidades.
- Configurar o Ollama para executar modelos de IA localmente.
- Implantar e interagir com LLMs usando o Ollama.
- Otimizar o desempenho e o uso de recursos para cargas de trabalho de IA.
- Explorar casos de uso para implantação de IA local em diversos setores.
Ollama e Privacidade de Dados: Padrões de Implantação Segura
14 HorasO Ollama é uma plataforma que permite executar modelos de linguagem grande (LLMs) e multimodais localmente, ao mesmo tempo em que oferece suporte a estratégias de implantação seguras.
Esta formação prática, ministrada por instrutor (online ou presencial), destina-se a profissionais de nível intermediário que desejam implementar o Ollama com rigorosas medidas de privacidade de dados e conformidade regulatória.
Ao final desta formação, os participantes serão capazes de:
- Implementar o Ollama de forma segura em ambientes containerizados e on-premise.
- Aplicar técnicas de privacidade diferencial para proteger dados sensíveis.
- Praticar log seguro, monitoramento e auditoria.
- Aplicar controle de acesso aos dados em conformidade com os requisitos regulatórios.
Formato do Curso
- Aula interativa e discussão.
- Laboratórios práticos com padrões de implantação seguros.
- Estudos de caso e exercícios práticos focados em conformidade.
Opções de Personalização do Curso
- Para solicitar uma formação personalizada para este curso, entre em contato conosco para organizarmos os detalhes.
Aplicações do Ollama no Setor Financeiro
14 HorasO Ollama é uma plataforma leve para execução de grandes modelos de linguagem (LLMs) localmente.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), destina-se a profissionais do setor financeiro e equipes de TI de nível intermediário que desejam implementar, personalizar e operacionalizar soluções de IA baseadas no Ollama em ambientes financeiros.
Ao concluir este treinamento, os participantes adquirirão as habilidades necessárias para:
- Implantar e configurar o Ollama para uso seguro nas operações financeiras.
- Integrar LLMs locais aos fluxos de trabalho de análise e relatórios.
- Adaptar os modelos à terminologia e às tarefas específicas do setor financeiro.
- Aplicar as melhores práticas de segurança, privacidade e conformidade.
Formato do Curso
- Aula interativa e discussões em grupo.
- Exercícios práticos com dados financeiros.
- Implementação em laboratório vivo de cenários focados no setor financeiro.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para agendar.
Aplicações do Ollama na Saúde
14 HorasO Ollama é uma plataforma leve para execução de grandes modelos de linguagem localmente.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), destina-se a profissionais de saúde de nível intermediário e equipes de TI que desejam implantar, personalizar e implementar soluções de IA baseadas no Ollama em ambientes clínicos e administrativos.
Ao concluir este treinamento, os participantes serão capazes de:
- Instalar e configurar o Ollama para uso seguro em ambientes de saúde.
- Integrar LLMs locais aos fluxos de trabalho clínicos e processos administrativos.
- Personalizar modelos para terminologia e tarefas específicas da área da saúde.
- Aplicar as melhores práticas de privacidade, segurança e conformidade regulatória.
Formato do Curso
- Aula interativa e discussão em grupo.
- Demonstrações práticas e exercícios guiados.
- Implementação prática em um ambiente simulado de saúde isolado (sandbox).
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar os detalhes.
Ollama para IA Responsável e Governança
14 HorasO Ollama é uma plataforma para execução de modelos de linguagem grande (LLM) e multimodais localmente, com suporte a governança e práticas de IA responsável.
Este treinamento ao vivo, ministrado por instrutor (online ou presencial), é voltado para profissionais de nível intermediário a avançado que desejam implementar equidade, transparência e responsabilidade em aplicações alimentadas pelo Ollama.
Ao final deste treinamento, os participantes serão capazes de:
- Aplicar princípios de IA responsável em implantações do Ollama.
- Implementar estratégias de filtragem de conteúdo e mitigação de viés.
- Projetar fluxos de trabalho de governança para alinhamento de IA e auditabilidade.
- Estabelecer estruturas de monitoramento e relatórios para conformidade.
Formato do Curso
- Palestras interativas e discussões.
- Laboratórios práticos de design de fluxos de trabalho de governança.
- Estudos de caso e exercícios focados em conformidade.
Opções de Personalização do Curso
- Para solicitar um treinamento personalizado para este curso, entre em contato conosco para organizar.
IA Soberana para Organizações Regulamentadas: Controlando Dados, Modelos e Ambientes de Inferência
7 HorasEsta formação ao vivo com instrutor em Brasil (online ou presencial) destina-se a líderes de TI de nível intermediário, profissionais de conformidade, equipes de segurança e arquitetos empresariais que desejam utilizar princípios de IA soberana e práticas de governança para projetar ambientes de IA que protejam dados sensíveis, atendam aos requisitos de localização e reduzam o bloqueio de fornecedor (vendor lock-in).
Ao final desta formação, os participantes serão capazes de: explicar conceitos de IA soberana, avaliar opções de hospedagem e governança, definir controles para prompts e logs, e criar um roteiro prático de adoção.