A resposta curta é: em parte. E entender exatamente qual parte é o que faz a
IA local valer a pena, em vez de virar uma instalação que você abre duas vezes
e esquece.
Testei isso num vídeo do canal com o Gemma rodando no LM Studio, num
computador comum. Este artigo resume o que funciona, o que não funciona, e
como você monta o seu em menos de meia hora.
Por que alguém rodaria IA no próprio computador
Três motivos, e só um deles é dinheiro.
Privacidade. Quando você cola um contrato, uma planilha da empresa ou um
documento pessoal num chat de IA na nuvem, aquilo sai da sua máquina. Com IA
local, não sai. O modelo roda no seu processador e na sua placa de vídeo, e o
arquivo nunca atravessa a internet.
Custo. As assinaturas dos assistentes de IA custam na faixa de 20 dólares
por mês. A IA local usa o hardware que você já tem.
Funciona sem internet. No avião, na estrada, com a conexão caindo.
Para quem trabalha com dado sensível, o primeiro motivo sozinho já resolve a
discussão.
Como montar em meia hora
- Baixe o LM Studio no site oficial,
lmstudio.ai, na versão do seu sistema. - Instale e abra.
- Na busca do meio da tela, procure o modelo. No vídeo usei o Gemma4 E2B,
que é leve e roda bem em máquina comum. - Escolha a versão na lista da direita e clique em baixar.
- Depois do download, abra o ícone de chat no menu da esquerda, selecione o
modelo no topo da tela e comece a conversar.
É isso. Não tem terminal, não tem configuração de servidor.
Duas palavras que você vai ver e precisa entender
Parâmetros, aquele "7B" ou "9B" no nome do modelo. É o tamanho do cérebro
da IA. Mais parâmetros costuma significar mais capacidade, mas também mais
memória de vídeo necessária. Se o modelo não cabe na sua placa, ele fica lento
ou nem abre.
Quantização em 4 bits. É uma compressão. Ela espreme um modelo pesado para
caber numa placa de 8 GB de memória de vídeo, perdendo muito pouco da
capacidade. É o que torna IA local viável num computador que não é de
laboratório.
Descubra quão rápida é a sua máquina
Nas configurações do chat, do lado direito, ative o modo de desenvolvedor ou
a exibição de métricas. A cada resposta vai aparecer um número em tokens por
segundo.
Esse número é a velocidade real da sua IA. Abaixo de uns 10 tokens por
segundo, a resposta aparece mais devagar do que você lê, e o uso fica
cansativo. Acima disso, a experiência é boa.
Quatro testes para fazer hoje
O material do vídeo tem os prompts completos, mas a ideia de cada um:
- Leitura de imagem. Fotografe uma anotação à mão e peça para transcrever
mantendo a estrutura. Dá para testar se o modelo enxerga. - Criar uma página. Peça uma landing page completa em HTML num arquivo só.
Dá para testar se ele programa. - Escrever com tato. Peça uma resposta profissional para o chefe cobrando
um relatório esquecido. Dá para testar se ele entende tom. - Analisar gasto. Cole uma lista de despesas do mês e peça os dois maiores
ralos de dinheiro. Dá para testar se ele raciocina com número.
Esse último é o melhor exemplo do porquê local importa: é exatamente o tipo de
dado que você não quer mandar para servidor de ninguém.
Então, dá para cancelar?
Não por completo, e é aqui que a maioria dos vídeos sobre o assunto erra.
A IA local não sabe o que aconteceu ontem. Ela foi treinada até uma certa data
e parou ali. Pergunte sobre uma notícia recente, uma cotação ou um
lançamento da semana, e ela vai responder com confiança uma coisa
desatualizada, ou inventar.
Então a divisão que funciona é esta:
| Use IA local para | Use IA conectada para |
|---|---|
| documento sensível, contrato, dado da empresa | notícia e atualidade |
| rascunho, revisão de texto, código | preço, cotação, dado em tempo real |
| tudo que você faria offline | qualquer fato que acabou de acontecer |
A IA local é o seu processador privado. Não é o seu jornal.
Se você usa IA principalmente para trabalhar com o que já está na sua mão,
dá para reduzir muito a dependência da assinatura. Se usa para se informar,
não dá.
Continue daqui
O vídeo completo, com os quatro testes rodando ao vivo e o resultado de cada
um, está no canal: IA no seu PC grátis, teste do Gemma4 E2B.
O manual com os prompts prontos para copiar está na Biblioteca, dentro do
Loop.
E se você travar na instalação ou o modelo ficar lento demais na sua máquina,
abre um loop na comunidade dizendo a configuração do seu computador. Eu
respondo, e a resposta fica lá para o próximo que tiver a mesma dúvida.
Continue no loop