Módulo 2 · Mão na massa

Instalando o Ollama e rodando o primeiro modelo

Aula 4 de 15 Aula de 35 min Atualizado em 29 de setembro de 2026
Progresso no curso27%

Nesta aula

Em menos de meia hora você vai ter um modelo respondendo no seu computador, sem nada sair dele.

Chegou a hora de colocar a mão no teclado. O Ollama é a ferramenta que eu uso para começar qualquer projeto de IA local, e por um motivo simples: ele esconde a complexidade. Um comando baixa o modelo, outro abre a conversa, e pronto. Nesta aula você instala, roda o primeiro modelo, faz cinco perguntas de teste e aprende os cinco comandos que vai usar pelo resto do curso. Vou dar o texto exato de cada um.

O que o Ollama faz por você

O Ollama é um programa gratuito, de código aberto, que cuida de três coisas: baixar modelos da biblioteca oficial, guardar esses modelos no seu disco e rodar cada um deles usando a memória e o processamento que a sua máquina tem. Ele escolhe sozinho se vai usar a placa de vídeo ou a memória comum, carrega o modelo quando você precisa e o descarrega da memória depois de um tempo sem uso.

Ele também abre um pequeno serviço no seu computador, no endereço http://localhost:11434. "localhost" quer dizer "esta máquina": só programas rodando no seu próprio computador conseguem falar com ele, por padrão. É por esse endereço que a interface da aula 5 e as integrações da aula 12 vão conversar com os modelos. Guarde esse número.

Depois do download, nada sai da máquina. Você pode desligar o Wi-Fi e a conversa continua. É essa a propriedade que faz o Ollama servir para o prontuário da clínica, a folha do escritório contábil ou o contrato da imobiliária.

Cuidado

Baixe o Ollama apenas de ollama.com, digitando o endereço na barra do navegador. Não use instalador vindo por e-mail, mensagem ou anúncio de busca. Instalador falso é um dos golpes mais comuns contra pequenas empresas, e "instalar uma IA" é a desculpa perfeita para ele.

Instalando no seu sistema

A instalação muda um pouco por sistema. Em todos, o teste final é o mesmo: abrir um terminal e digitar ollama list. Se aparecer uma lista (mesmo vazia), está instalado.

Windows

  1. Acesse ollama.com e baixe o instalador para Windows.
  2. Execute o arquivo e siga o assistente. O Ollama fica rodando em segundo plano, com um ícone perto do relógio.
  3. Abra o Prompt de Comando ou o PowerShell (procure por "cmd" ou "PowerShell" no menu Iniciar) e digite ollama list.

macOS

  1. Acesse ollama.com e baixe o aplicativo para Mac.
  2. Abra o arquivo baixado e arraste o Ollama para a pasta Aplicativos. Abra o aplicativo uma vez; ele passa a rodar em segundo plano.
  3. Abra o Terminal (procure por "Terminal" no Spotlight) e digite ollama list.

Linux

  1. Acesse ollama.com e abra a página de download para Linux. Ela mostra um comando de instalação de uma linha, no formato curl -fsSL https://ollama.com/install.sh | sh.
  2. Esse comando baixa um script do site oficial e o executa. É o jeito documentado, mas vale a regra de sempre: copie o comando da página oficial, não de um fórum. Se a sua equipe de TI preferir, o script pode ser baixado e lido antes de rodar.
  3. No terminal, digite ollama list. Se o serviço não estiver rodando, ollama serve inicia o serviço manualmente.

Dica

Não sabe o que é terminal? É uma janela onde você digita comandos em texto e vê a resposta em texto. Você só vai precisar dos comandos desta aula, sempre com o texto exato. Copie, cole, dê Enter. Ninguém nasce sabendo.

O primeiro modelo

Vamos baixar um modelo pequeno, que cabe em quase qualquer máquina. Uso o llama3.2 como exemplo porque a versão padrão dele é leve e boa para aprender. Se os seus candidatos da aula 2 forem outros, a receita é a mesma: só muda o nome.

Baixar

ollama pull llama3.2

O download leva alguns minutos, dependendo da internet. Se cair no meio, rode o mesmo comando de novo: ele continua de onde parou. Os nomes na biblioteca seguem o padrão família:tamanho. Sem o sufixo, o Ollama pega a versão padrão daquela família; com sufixo, você escolhe: por exemplo, llama3.2:1b é a versão menor da mesma família. Confira os nomes exatos e os tamanhos na ficha do modelo em ollama.com, porque eles mudam com o tempo.

Conversar

ollama run llama3.2

Abre uma conversa no próprio terminal. Digite uma pergunta, dê Enter, e a resposta aparece palavra por palavra. Para sair, digite /bye. Se o modelo não estiver baixado, o run baixa antes de abrir.

As cinco perguntas de teste

Não pergunte "quem descobriu o Brasil". Pergunte o que a sua empresa vai pedir de verdade, sem dado real. Estas são as cinco que eu uso para qualquer negócio, aqui com o exemplo de uma loja de material de construção:

1. Resuma em 3 frases o texto a seguir, em português: [cole um parágrafo de um manual ou de um e-mail sem dado pessoal]. 2. Classifique a mensagem a seguir em uma destas categorias: orçamento, reclamação, dúvida de entrega, outro. Responda só com a categoria. Mensagem: "Oi, comprei 20 sacos de cimento na terça e até agora não chegou, o que houve?" 3. Extraia do texto a seguir: nome do produto, quantidade e prazo, em formato de lista. Texto: "Preciso de 40 metros de cano de 25 mm até sexta, e se tiver também 10 joelhos do mesmo tamanho." 4. Escreva uma mensagem curta e cordial, sem emoji, avisando um cliente que o pedido dele está pronto para retirada no balcão. 5. Monte uma tabela com 3 colunas (produto, unidade, uso mais comum) para: cimento, areia, brita, cal.

Repare no que cada uma mede: resumo, classificação, extração, redação e formato. São as cinco tarefas que quase toda empresa pede a uma IA. Anote a resposta e dê uma nota de 1 a 5 para cada. Na aula 6 essa bateria vira o método de escolha de modelo.

Exemplo real

Uma padaria com três lojas testou a pergunta 2 com as mensagens que recebe no WhatsApp (sem nome e sem telefone). O modelo pequeno acertou a categoria na maioria, mas confundia "reclamação" com "dúvida de entrega" quando a mensagem tinha as duas coisas. A solução não foi trocar de modelo: foi reescrever a pergunta dizendo "se houver reclamação, ela tem prioridade". Pedido bem feito vale mais do que modelo grande.

Os cinco comandos que você vai usar

ComandoO que fazQuando usar
ollama pull NOMEBaixa o modelo (ou atualiza, se já existe)Ao instalar um modelo novo ou pegar uma versão mais recente
ollama run NOMEAbre a conversa com o modelo no terminalPara testar rápido, sem interface
ollama listMostra os modelos instalados, com tamanhoPara saber o que você tem e quanto disco ocupa
ollama psMostra os modelos carregados na memória agoraPara entender por que a máquina está lenta ou cheia
ollama rm NOMEApaga o modelo do discoPara liberar espaço quando um modelo perdeu no teste

Uma observação sobre o ps: o Ollama mantém o modelo na memória por um tempo depois da última pergunta, para a próxima vir mais rápido, e depois descarrega sozinho. Se a máquina está apertada de memória e você vê dois modelos carregados, é só esperar ou reiniciar o serviço.

Problemas comuns e o que fazer

Prática · 10 min

Rode o primeiro modelo e teste cinco perguntas

  1. Instale o Ollama a partir de ollama.com seguindo o passo do seu sistema. Confirme com ollama list.
  2. Baixe o modelo: ollama pull llama3.2 (ou o primeiro candidato da aula 2, se ele couber na sua máquina).
  3. Abra a conversa: ollama run llama3.2. Faça uma pergunta qualquer só para ver a resposta chegar.
  4. Faça as cinco perguntas de teste desta aula, adaptadas ao seu negócio, sem dado real. Copie cada resposta para o seu documento de entregáveis.
  5. Dê uma nota de 1 a 5 para cada resposta e anote, de relógio, quanto tempo levou.
  6. Saia com /bye, rode ollama ps e ollama list e anote o que cada um mostrou.
Entregável: o Ollama instalado, um modelo rodando, e um registro com as 5 perguntas, as 5 respostas, a nota de cada uma e o tempo aproximado. É a linha de base para a aula 6.

Resumo da aula

Quiz da aula

Quatro perguntas para fixar. A melhor nota fica guardada para o certificado.

Aula 4 de 15

Antes de seguir para a próxima aula

Coloque em prática o que viu. As caixas ficam marcadas neste navegador, para você voltar depois.

Ficou com dúvida nesta aula? O time da IV Help responde pessoalmente no WhatsApp.

Perguntar no WhatsApp