Nesta aula
O custo real da IA local é gente. Esta aula é sobre o que essa gente faz.
Os guias que eu cito desde a aula 1 são unânimes: operar uma IA local exige de meia a uma pessoa dedicada para atualizar modelos, monitorar e responder a incidentes. Numa empresa pequena, isso não vira um cargo novo; vira parte do papel de alguém, com nome, substituto e tempo reservado na agenda. Nesta aula eu descrevo o que essa pessoa faz na semana, no mês e no trimestre, e como responder quando algo dá errado, porque vai dar. No fim, você monta a rotina semanal da sua operação.
- Ao final, você vai saber atualizar modelos e programas sem apostar a operação num download.
- Vai monitorar os sinais que importam e responder a incidentes com método.
- Vai sair com um entregável: a rotina semanal de operação, com responsável, substituto e checklist.
Quem cuida
A primeira decisão da operação é um nome. Não "a TI", não "a equipe": uma pessoa, e uma segunda que sabe fazer o básico quando a primeira está de férias. Se a sua empresa não tem quem possa assumir isso, a decisão honesta é não operar IA local, ou contratar quem opere. A aula 1 já dizia: sem esse nome, o curso te ensina a decidir não fazer.
O que a pessoa responsável faz
- Mantém o ambiente atualizado (modelos, Ollama, interface, sistema), com teste antes de cada mudança.
- Olha os sinais toda semana e age antes de a equipe reclamar.
- Recebe e trata incidentes, registra e comunica.
- Administra contas: cria, desativa no dia da saída, revisa permissões.
- Cuida das coleções com os donos dos documentos (aula 8).
- Mantém a política (aula 11) e o desenho do ambiente (aula 10) em dia.
- Faz e testa backups.
Quanto tempo isso leva depende do tamanho da operação. Para uma equipe de dez pessoas com duas coleções e uma integração, a rotina cabe em algumas horas por semana, com picos quando sai modelo novo ou acontece incidente. Reserve o tempo na agenda; rotina que "faz quando der" não acontece.
Dica
A substituta não precisa saber tudo. Precisa saber quatro coisas: reiniciar o serviço, restaurar o backup, desativar uma conta e a quem ligar. Escreva essas quatro numa página e faça a pessoa executar cada uma pelo menos uma vez.
Atualizar sem quebrar
Três coisas se atualizam: os modelos, os programas (Ollama e interface) e o sistema operacional. Cada uma tem um risco diferente.
Modelos
Sai modelo novo todo mês, e a tentação de trocar é grande. A regra: versão nova é candidata, não vencedora. O caminho é o da aula 6:
- Baixe a nova versão com
ollama pull, mantendo a atual instalada. As duas convivem no disco;ollama listmostra ambas. - Rode a bateria de testes na nova, com a mesma rubrica, e compare com o registro da atual.
- Se a nova for melhor de forma clara, troque o modelo padrão na interface e nas integrações. Se não for, fique com a atual e registre por quê.
- Depois de uma ou duas semanas sem problema, remova a antiga com
ollama rmpara liberar disco.
O outro lado da moeda é a armadilha que os guias apontam: tratar modelo antigo como seguro. Modelo não "estraga", mas o mundo muda: surgem modelos que inventam menos, entendem melhor o português e cabem na mesma memória. Por isso a rodada trimestral da bateria existe mesmo quando ninguém reclamou.
Programas
Ollama e interface recebem atualizações frequentes, com correções de segurança. Atualize em janela combinada (fora do horário de pico), com backup feito antes e um teste rápido depois: abrir a interface, fazer uma pergunta, consultar uma coleção, rodar uma chamada de API. Leia as notas da versão; de vez em quando muda algo que afeta a sua configuração.
Sistema operacional
A máquina da IA é um servidor. Patches de segurança do sistema entram no mesmo ritmo dos outros computadores da empresa, e a máquina reinicia em horário combinado. Máquina sem patch numa rede interna é a porta que a aula 10 mandou fechar.
Exemplo real
Uma imobiliária trocou de modelo numa sexta porque "o novo era melhor no ranking". Na segunda, o resumo de contratos passou a vir em inglês numa em cada cinco vezes. A bateria teria pegado isso em quinze minutos. Voltaram para o anterior, rodaram a bateria na semana seguinte, ajustaram a instrução fixa, e só então trocaram de vez.
Monitorar: os sinais que importam
Monitorar não é olhar gráfico bonito. É uma planilha semanal com meia dúzia de linhas, preenchida pela pessoa responsável, e um olhar treinado para o que mudou.
| Sinal | Como ver | O que indica |
|---|---|---|
| Memória e modelos carregados | ollama ps e o monitor do sistema | Dois modelos carregados numa máquina apertada explicam lentidão |
| Disco | Espaço livre; ollama list para ver o tamanho dos modelos | Modelos antigos acumulados; disco cheio derruba a interface |
| Lentidão | Tempo de resposta numa pergunta padrão, medido toda semana | Mais usuários que a máquina aguenta, ou modelo trocado sem querer |
| Taxa de "não encontrei" | Amostra do histórico ou relato da equipe | Documento faltando ou desatualizado nas coleções |
| Qualidade | Amostra de 10 conversas por semana, conferida contra a fonte | Invenção, fonte errada, instrução ignorada |
| Erros de API | Registro das integrações | Serviço parado, modelo renomeado, JSON quebrado |
| Uso fora do padrão | Trilha de auditoria (aula 11) | Conta usando de madrugada, volume anormal, acesso a coleção restrita |
A amostra de dez conversas é o sinal mais valioso e o mais negligenciado. Dez conversas por semana, escolhidas ao acaso, conferidas contra a fonte com a rubrica da aula 6. Se a taxa de invenção subir, você descobre antes do cliente. Lembre da política: a amostra é lida com justificativa e dentro do prazo de retenção, não para vigiar quem perguntou.
Cuidado
Monitoramento que vira vigilância de produtividade ("fulano usou pouco a IA") destrói a confiança da equipe e cria problema jurídico. Os sinais são da máquina, das coleções e da qualidade. Pessoa entra no monitoramento só em caso de uso anormal com indício de incidente.
Responder a incidentes
Incidente é qualquer coisa que a operação não previa: máquina caiu, resposta errada chegou ao cliente, alguém acessou o que não devia, documento sensível entrou na coleção geral por engano, suspeita de vazamento. O método é o mesmo para todos, em quatro passos.
- Conter. Parar o que está causando dano: pausar a integração, desativar a conta, tirar o documento da coleção, desligar a máquina da rede se for o caso. Antes de entender a causa.
- Registrar. Data, hora, o que aconteceu, quem percebeu, o que foi feito. No mesmo dia, num registro que sobreviva (não numa conversa de mensagem).
- Comunicar. A quem a política diz (aula 11). Se envolver dado pessoal, quem responde pela LGPD decide se a ANPD e os titulares precisam ser avisados; isso tem prazo e não é decisão da pessoa responsável pela operação sozinha.
- Corrigir e aprender. Investigar a causa, corrigir, e escrever o que mudou na rotina para não repetir. Um incidente sem mudança de rotina é um incidente que vai voltar.
Você pode usar um assistente de nuvem para montar o modelo de registro de incidente, porque ele não tem dado real:
A rotina: semana, mês, trimestre
Toda semana
Olhar os sete sinais da tabela. Conferir a amostra de 10 conversas. Verificar que o backup rodou. Ler os pedidos de documento novo. Responder às dúvidas da equipe. Anotar tudo na planilha.
Todo mês
Atualizar Ollama e interface em janela combinada. Revisar contas e permissões (quem saiu? quem mudou de área?). Conferir as coleções com os donos. Ver se saiu modelo candidato e agendar a bateria.
Todo trimestre
Rodar a bateria completa no modelo atual e nos candidatos. Testar a restauração do backup. Revisar o inventário de documentos, a política e o desenho do ambiente. Revisar o custo real (aula 14).
A rotina cabe numa página, com caixas para marcar. Ela é o que transforma "a gente cuida" em "está cuidado": quando alguém perguntar, você mostra a planilha das últimas semanas.
Prática · 10 min
Monte a rotina semanal de operação
- Escreva o nome da pessoa responsável e da substituta. Se não houver, escreva "a definir" e a data-limite para definir.
- Monte o checklist semanal com os sete sinais da tabela, o backup e a amostra de 10 conversas. Uma linha por item, com "como ver" ao lado.
- Acrescente as tarefas mensais e trimestrais, com o mês ou a data prevista da primeira ocorrência.
- Crie o registro de incidentes com os campos desta aula, mesmo que fique vazio.
- Escreva a página da substituta: reiniciar o serviço, restaurar o backup, desativar uma conta, a quem ligar.
- Marque a primeira rodada semanal no calendário da pessoa responsável, com hora.
Resumo da aula
- Operação precisa de um nome, um substituto e tempo reservado. Sem isso, não opere.
- Modelo novo é candidato: baixa mantendo o atual, roda a bateria, troca só se for melhor, remove o antigo depois. Modelo antigo também se testa.
- Programas e sistema atualizam em janela, com backup antes e teste depois.
- Sete sinais semanais, com a amostra de 10 conversas conferida contra a fonte como o mais valioso.
- Incidente: conter, registrar, comunicar (LGPD decide sobre ANPD e titulares), corrigir e mudar a rotina.
- Rotina em uma página: semana, mês, trimestre, com caixas para marcar.
Quiz da aula
Quatro perguntas para fixar. A melhor nota fica guardada para o certificado.
Isaque Victor cursos gratuitos