Nesta aula
Em menos de meia hora você vai ter um modelo respondendo no seu computador, sem nada sair dele.
Chegou a hora de colocar a mão no teclado. O Ollama é a ferramenta que eu uso para começar qualquer projeto de IA local, e por um motivo simples: ele esconde a complexidade. Um comando baixa o modelo, outro abre a conversa, e pronto. Nesta aula você instala, roda o primeiro modelo, faz cinco perguntas de teste e aprende os cinco comandos que vai usar pelo resto do curso. Vou dar o texto exato de cada um.
- Ao final, você vai ter o Ollama instalado e um modelo aberto respondendo no seu computador.
- Vai dominar os comandos pull, run, list, rm e ps, e saber o que cada um faz.
- Vai sair com um entregável: o registro das 5 perguntas de teste, com as respostas e a sua avaliação.
O que o Ollama faz por você
O Ollama é um programa gratuito, de código aberto, que cuida de três coisas: baixar modelos da biblioteca oficial, guardar esses modelos no seu disco e rodar cada um deles usando a memória e o processamento que a sua máquina tem. Ele escolhe sozinho se vai usar a placa de vídeo ou a memória comum, carrega o modelo quando você precisa e o descarrega da memória depois de um tempo sem uso.
Ele também abre um pequeno serviço no seu computador, no endereço http://localhost:11434. "localhost" quer dizer "esta máquina": só programas rodando no seu próprio computador conseguem falar com ele, por padrão. É por esse endereço que a interface da aula 5 e as integrações da aula 12 vão conversar com os modelos. Guarde esse número.
Depois do download, nada sai da máquina. Você pode desligar o Wi-Fi e a conversa continua. É essa a propriedade que faz o Ollama servir para o prontuário da clínica, a folha do escritório contábil ou o contrato da imobiliária.
Cuidado
Baixe o Ollama apenas de ollama.com, digitando o endereço na barra do navegador. Não use instalador vindo por e-mail, mensagem ou anúncio de busca. Instalador falso é um dos golpes mais comuns contra pequenas empresas, e "instalar uma IA" é a desculpa perfeita para ele.
Instalando no seu sistema
A instalação muda um pouco por sistema. Em todos, o teste final é o mesmo: abrir um terminal e digitar ollama list. Se aparecer uma lista (mesmo vazia), está instalado.
Windows
- Acesse ollama.com e baixe o instalador para Windows.
- Execute o arquivo e siga o assistente. O Ollama fica rodando em segundo plano, com um ícone perto do relógio.
- Abra o Prompt de Comando ou o PowerShell (procure por "cmd" ou "PowerShell" no menu Iniciar) e digite
ollama list.
macOS
- Acesse ollama.com e baixe o aplicativo para Mac.
- Abra o arquivo baixado e arraste o Ollama para a pasta Aplicativos. Abra o aplicativo uma vez; ele passa a rodar em segundo plano.
- Abra o Terminal (procure por "Terminal" no Spotlight) e digite
ollama list.
Linux
- Acesse ollama.com e abra a página de download para Linux. Ela mostra um comando de instalação de uma linha, no formato
curl -fsSL https://ollama.com/install.sh | sh. - Esse comando baixa um script do site oficial e o executa. É o jeito documentado, mas vale a regra de sempre: copie o comando da página oficial, não de um fórum. Se a sua equipe de TI preferir, o script pode ser baixado e lido antes de rodar.
- No terminal, digite
ollama list. Se o serviço não estiver rodando,ollama serveinicia o serviço manualmente.
Dica
Não sabe o que é terminal? É uma janela onde você digita comandos em texto e vê a resposta em texto. Você só vai precisar dos comandos desta aula, sempre com o texto exato. Copie, cole, dê Enter. Ninguém nasce sabendo.
O primeiro modelo
Vamos baixar um modelo pequeno, que cabe em quase qualquer máquina. Uso o llama3.2 como exemplo porque a versão padrão dele é leve e boa para aprender. Se os seus candidatos da aula 2 forem outros, a receita é a mesma: só muda o nome.
Baixar
ollama pull llama3.2
O download leva alguns minutos, dependendo da internet. Se cair no meio, rode o mesmo comando de novo: ele continua de onde parou. Os nomes na biblioteca seguem o padrão família:tamanho. Sem o sufixo, o Ollama pega a versão padrão daquela família; com sufixo, você escolhe: por exemplo, llama3.2:1b é a versão menor da mesma família. Confira os nomes exatos e os tamanhos na ficha do modelo em ollama.com, porque eles mudam com o tempo.
Conversar
ollama run llama3.2
Abre uma conversa no próprio terminal. Digite uma pergunta, dê Enter, e a resposta aparece palavra por palavra. Para sair, digite /bye. Se o modelo não estiver baixado, o run baixa antes de abrir.
As cinco perguntas de teste
Não pergunte "quem descobriu o Brasil". Pergunte o que a sua empresa vai pedir de verdade, sem dado real. Estas são as cinco que eu uso para qualquer negócio, aqui com o exemplo de uma loja de material de construção:
Repare no que cada uma mede: resumo, classificação, extração, redação e formato. São as cinco tarefas que quase toda empresa pede a uma IA. Anote a resposta e dê uma nota de 1 a 5 para cada. Na aula 6 essa bateria vira o método de escolha de modelo.
Exemplo real
Uma padaria com três lojas testou a pergunta 2 com as mensagens que recebe no WhatsApp (sem nome e sem telefone). O modelo pequeno acertou a categoria na maioria, mas confundia "reclamação" com "dúvida de entrega" quando a mensagem tinha as duas coisas. A solução não foi trocar de modelo: foi reescrever a pergunta dizendo "se houver reclamação, ela tem prioridade". Pedido bem feito vale mais do que modelo grande.
Os cinco comandos que você vai usar
| Comando | O que faz | Quando usar |
|---|---|---|
ollama pull NOME | Baixa o modelo (ou atualiza, se já existe) | Ao instalar um modelo novo ou pegar uma versão mais recente |
ollama run NOME | Abre a conversa com o modelo no terminal | Para testar rápido, sem interface |
ollama list | Mostra os modelos instalados, com tamanho | Para saber o que você tem e quanto disco ocupa |
ollama ps | Mostra os modelos carregados na memória agora | Para entender por que a máquina está lenta ou cheia |
ollama rm NOME | Apaga o modelo do disco | Para liberar espaço quando um modelo perdeu no teste |
Uma observação sobre o ps: o Ollama mantém o modelo na memória por um tempo depois da última pergunta, para a próxima vir mais rápido, e depois descarrega sozinho. Se a máquina está apertada de memória e você vê dois modelos carregados, é só esperar ou reiniciar o serviço.
Problemas comuns e o que fazer
- "model not found". O nome está errado ou o modelo não foi baixado. Confira o nome exato na biblioteca e rode
ollama pull. - Resposta muito lenta. O modelo está grande demais para a memória disponível. Tente uma versão menor da mesma família e feche programas pesados (navegador com muitas abas conta).
- Erro de memória. Mesma causa, versão mais grave. Modelo menor.
- "não foi possível conectar". O serviço não está rodando. No Windows e no Mac, abra o aplicativo do Ollama; no Linux,
ollama serve. - Download travado. Rode o
pullde novo; ele retoma.
Prática · 10 min
Rode o primeiro modelo e teste cinco perguntas
- Instale o Ollama a partir de ollama.com seguindo o passo do seu sistema. Confirme com
ollama list. - Baixe o modelo:
ollama pull llama3.2(ou o primeiro candidato da aula 2, se ele couber na sua máquina). - Abra a conversa:
ollama run llama3.2. Faça uma pergunta qualquer só para ver a resposta chegar. - Faça as cinco perguntas de teste desta aula, adaptadas ao seu negócio, sem dado real. Copie cada resposta para o seu documento de entregáveis.
- Dê uma nota de 1 a 5 para cada resposta e anote, de relógio, quanto tempo levou.
- Saia com
/bye, rodeollama pseollama liste anote o que cada um mostrou.
Resumo da aula
- O Ollama baixa, guarda e roda modelos abertos, e abre um serviço local em localhost:11434.
- Instalador só de ollama.com. Teste de instalação:
ollama list. ollama pullbaixa;ollama runconversa;/byesai. Nomes seguem o padrão família:tamanho.- Depois do download, nada sai da máquina. A internet só serve para baixar.
list,psermcuidam do que está instalado, carregado e do que pode ser apagado.- Lentidão quase sempre é modelo grande demais: versão menor antes de qualquer compra.
Quiz da aula
Quatro perguntas para fixar. A melhor nota fica guardada para o certificado.
Isaque Victor cursos gratuitos