IA grátis no seu PC, sem mensalidade e sem internet

Instale uma IA grátis no seu Windows, use sem limite e sem internet, crie a sua própria IA com nome e personalidade e termine com uma IA gigante fazendo um jogo para você. O passo a passo é numa NVIDIA e vale para outras placas.

Johnny Helder · Windows 10 e 11 · passo a passo numa NVIDIA · atualizado em

O que você vai conseguir

  1. Instalar uma IA no seu PC com um comando, sem pagar e sem criar conta.
  2. Conversar com ela sem internet. O que você escreve não sai do computador.
  3. Provar que é a placa de vídeo que trabalha e medir quantas palavras por segundo ela gera.
  4. Criar a sua própria IA, com nome, personalidade e regras suas, virando um comando só seu.
  5. Falar com a sua IA pelo celular, por um bot no Telegram que só atende você.
  6. Usar a IA de terminal, a que tem as mãos no computador e constrói coisas para você.
  7. Transcrever um print e transformar uma foto sua em prompt de personagem, sem a imagem sair do PC.
  8. Pedir a uma IA gigante na nuvem que crie um jogo de navegador, de graça, e aprender a corrigir os erros.

Tempo total. Cerca de 30 minutos até a primeira conversa, quase tudo download. O guia inteiro, com os dois projetos, leva de 2 a 3 horas.

Custo. Zero. O Ollama e os modelos são gratuitos. Você gasta luz e espaço no disco. O projeto do jogo usa internet, tem limite diário e precisa da conta de um adulto.

Para quem é. Quem tem PC ou notebook gamer e nunca instalou uma IA. Não precisa saber programar. Pais e adultos curiosos também. Se você cuida de alguém de 13 a 17 anos, leia antes Para pais e responsáveis. Se você mesmo tem 16 ou 17, leia também, porque a parte das contas online vale para você.

O guia foi feito num notebook com RTX 3050 de 6 GB e 16 GB de RAM, mais fraco que o PC gamer típico de hoje. A segunda máquina da aula tem uma RTX 5060 de 8 GB. Os comandos são os mesmos em placas AMD e Intel, que o Ollama também aceita, e até sem placa nenhuma, rodando no processador, bem mais devagar. Como não testamos essas marcas, os detalhes ficam na documentação de GPUs e na pergunta sobre AMD e Intel em Perguntas frequentes.

Para pais e responsáveis

IA em casa pode ensinar muito ou virar atalho para não pensar. Cinco combinados. O peso de cada um muda com a idade. Dos 13 aos 15, a Common Sense Media recomenda uso acompanhado para estudo e criatividade. Dos 16 aos 17, a conversa vale mais que a vigilância, e o combinado 5 continua valendo porque é contrato, não confiança.

  1. A primeira vez, juntos. Instalar do lado é o que mais ensina, e depois ele segue sozinho. Se o seu filho já tem 16 ou 17, combine em vez de supervisionar.
  2. IA local não tem filtro de fora. Nada sai do PC, mas nenhuma empresa modera. Existem modelos "sem filtro" (uncensored, abliterated) a um comando de distância. Modelo novo só com você sabendo. O ollama list mostra o que está instalado.
  3. IA não é amigo nem terapeuta. Ela inventa com confiança. Sentimento se conversa com gente.
  4. Aprender, não terminar. O MEC (abril de 2026) alerta contra entregar à máquina o esforço de pensar. A pergunta que resolve quase tudo é "essa IA está me ajudando a aprender ou só a terminar?".
  5. Conta online é de adulto. O uso local não pede conta. Ollama e OpenRouter (projeto do jogo) exigem 18 anos para contas e serviços. Nada de nome, escola, endereço ou fotos de pessoas em IA online.

Começo rápido

Para ver funcionando agora, com o passo a passo feito numa placa NVIDIA. Cada passo tem uma parte detalhada mais abaixo.

  1. Veja o tamanho da sua placa primeiro. Aperte Ctrl + Shift + Esc, vá em Desempenho, clique na GPU com NVIDIA no nome e leia a Memória dedicada da GPU. É esse número que decide qual IA cabe (Sua placa aguenta?).
Memória da placaComece por
4 GBqwen3.5:2b
6 GB ou maisqwen3.5:4b
8 GB ou maisqwen3.5:4b agora e qwen3.5:9b depois
  1. Aperte a tecla do Windows, digite PowerShell e clique em Windows PowerShell (não como administrador). A última linha precisa começar com PS C:\Users\ e terminar com >. Se não for assim, veja Abra o terminal certo.
  2. Cole este comando e aperte Enter. Ele instala o Ollama pelo site oficial (Instale o Ollama).
PowerShell
irm https://ollama.com/install.ps1 | iex
  1. Quando terminar, feche o PowerShell, abra de novo e confira. Tem que aparecer ollama version is e um número.
PowerShell
ollama --version
  1. Baixe e abra a IA que você escolheu na tabela do passo 1. O qwen3.5:4b tem 3,4 GB e baixa só na primeira vez (Baixe a sua primeira IA).
PowerShell
ollama run qwen3.5:4b
  1. Quando a linha mudar para >>> Send a message (/? for help), escreva a sua pergunta em português e aperte Enter (Primeiras conversas).
  2. Para sair, digite o comando abaixo. Para voltar outro dia, repita o passo 5. Deu algo diferente? Veja Deu erro?.
Cole na conversa com a IA
/bye

0 de 17 etapas

  1. Tudo depende da memória da placa de vídeo (VRAM). Não é a RAM do PC nem o disco.

    Como ver a memória da sua placa

    1. Aperte Ctrl + Shift + Esc para abrir o Gerenciador de Tarefas. No Windows 10, se abrir pequeno, clique em Mais detalhes.
    2. Vá em Desempenho e clique na GPU dedicada, que é a que tem NVIDIA, AMD ou Intel Arc no nome. Notebook costuma ter duas, e a boa é a de maior memória.
    3. Procure Memória dedicada da GPU. O nome varia conforme a versão e o idioma do Windows e pode aparecer como "Memória de GPU dedicada" ou "Dedicated GPU memory". O segundo número (em 0,4/6,0 GB) é a memória da placa. Arredonde para 4, 6, 8, 12, 16 ou 24.
    4. Ignore a Memória compartilhada. É RAM emprestada e lenta.
    5. Anote a Versão do driver, na mesma tela.

    Exemplos comuns (várias placas têm versões com memórias diferentes, então confira).

    MemóriaExemplos
    4 GBGTX 1650, RTX 3050 de notebook (4 GB)
    6 GBRTX 3050 de notebook (6 GB), RTX 2060, GTX 1660
    8 GBRTX 4060, RTX 5060, RTX 3060 Ti, RTX 3070
    12 GBRTX 3060 (12 GB), RTX 4070, RTX 5070
    16 GBRTX 4060 Ti e 5060 Ti (16 GB), RTX 4080, RTX 5080
    24 GBRTX 3090, RTX 4090

    Por que a memória manda, com LEGO

    Um modelo de IA é feito de parâmetros, como peças de LEGO. 4b no nome quer dizer 4 bilhões de peças. A memória da placa é a mesa. Se tudo cabe, a montagem é rápida. Se não cabe, parte vai para o chão (a RAM) e o processador perde tempo abaixando para pegar peça.

    Os modelos vêm comprimidos, como foto no WhatsApp, e cada bilhão de peças ocupa uns 0,6 a 0,7 GB. A mesa também guarda a conversa. Abaixo de 24 GB, o Ollama reserva por padrão 4 mil tokens (pedaços de palavra). O Windows e os programas abertos usam outro pedaço.

    A regra que vale

    Tamanho do download + 1 GB de folga precisa ser menor que a memória da placa.

    Numa placa de 6 GB, o qwen3.5:4b (3,4 GB) cabe. O qwen3.5:9b (6,6 GB) não cabe inteiro. Olhe o download, não o nome. O gemma4:e4b-it-qat tem "4b" no nome, mas traz peças para imagem e som e baixa 6,1 GB.

    Qual modelo cabe na sua placa

    Tamanhos de ollama.com/library em 17 de setembro de 2026. É conta de espaço, não teste de velocidade nem de qualidade.

    PlacaModelo (tag exata)DownloadFotos?Como fica
    4 GBqwen3:4b2,5 GBNãoJusto
    4 GBqwen3.5:2b2,7 GBSimJusto
    6 GBgemma3:4b3,3 GBSimFolgado
    6 GBqwen3.5:4b3,4 GBSimFolgado
    6 GBgemma4:e2b-it-qat4,3 GBSimJusto
    8 GBqwen3:8b5,2 GBNãoFolgado
    8 GBgemma4:e4b-it-qat6,1 GBSimJusto
    8 GBqwen3.5:9b6,6 GBSimJusto
    12 GBgemma4:12b-it-qat7,2 GBSimFolgado
    12 GBgemma3:12b8,1 GBSimFolgado
    12 GBqwen3:14b9,3 GBNãoFolgado
    16 GBgemma4:12b-it-q8_013 GBSimFolgado
    24 GBgemma4:26b-a4b-it-qat16 GBSimFolgado
    24 GBqwen3.5:27b17 GBSimFolgado
    24 GBqwen3:30b19 GBNãoNo limite
    • Cada placa roda também os modelos das linhas menores.
    • Folgado, sobra 1 GB ou mais depois da regra. Justo, sobra menos, então feche jogo, Discord e navegador.
    • No limite, com os 4 a 5 GB de folga da placa de 24 GB a conta fecha no máximo e pode dividir com o processador. Prefira o qwen3.5:27b ou o gemma4:26b-a4b-it-qat.
    • q8_0 é compressão mais leve, como foto em HD. Mais fiel e um pouco mais lenta.
    • Foto ocupa memória extra. Num modelo Justo, mandar imagem pode empurrar parte dele para o processador.
    • Não sabe por onde começar? Com 6 GB ou mais, qwen3.5:4b, usado no guia inteiro. O gemma3:4b é a segunda opinião.

    Caber não garante escrever bem em português. Veja o nosso tropeço em Qual IA é melhor em português?.

Consulta rápida

Deu erro?

A mensagem pode vir em português ou inglês, conforme o Windows.

1. O comando ollama não é reconhecido

A janela ainda não sabe do Ollama. Feche todas as janelas do PowerShell, abra de novo e rode ollama --version. Se continuar, reinicie o PC. Se ainda falhar, use winget install Ollama.Ollama.

2. Você está no terminal errado

A linha termina com ~$. Ignore a sugestão que aparece na tela e abra o Windows PowerShell (Abra o terminal certo).

3. Você está no Prompt de Comando

A linha começa com C:\Users\ sem PS. Abra o Windows PowerShell e instale de novo.

4. Execução de scripts desabilitada

Uma trava do Windows, comum em PCs de escola e empresa. Não mude a "ExecutionPolicy", isso abre a porta para scripts maliciosos. Instale pelo winget, ou baixe o OllamaSetup.exe em https://ollama.com/download/windows. Se o PC é da escola ou do trabalho, fale com o responsável.

PowerShell
winget install Ollama.Ollama

Se o próprio winget não for reconhecido, use o instalador do site e rode o Windows Update.

5. Download lento ou parado

Às vezes a porcentagem só para. Aperte Ctrl+C, pause outros downloads, chegue perto do roteador e rode o mesmo ollama run qwen3.5:4b. Normalmente ele continua de onde parou.

6. Nome do modelo errado

Erro de digitação, como qwen35:4b sem o ponto. Use o botão de copiar do guia.

7. Resposta muito lenta

Não aparece erro, a IA só escreve devagar. Quase sempre ela não coube na placa.

  1. Rode ollama ps numa segunda janela. Se não aparecer 100% GPU, veja Prove que é a sua placa.
  2. Troque por um modelo menor, como qwen3.5:4b ou gemma3:4b.
  3. Feche jogos e programas pesados, que também ocupam a placa.
  4. Desligue o modo de pensar com /set nothink.
  5. 100% CPU com modelo pequeno? Confira o driver com nvidia-smi (Requisitos).

8. Responde em inglês ou escreve mal em português

Nem toda IA pequena aprendeu bem o português. Peça na primeira mensagem.

Cole na conversa com a IA
A partir de agora, responda sempre em português do Brasil, com frases simples.

Ou dê um papel fixo à IA, como um ator que lê o personagem antes da peça.

Cole na conversa com a IA
/set system "Você é um assistente que sempre responde em português do Brasil, com frases simples."

Thinking... em inglês é normal. Se a resposta continuar ruim, troque de modelo (Qual IA é melhor em português?).

9. Falta memória no computador

Falta memória RAM livre no computador para carregar o modelo. Não é falta de disco. Acontece quando o modelo é grande demais para o PC ou quando navegador, jogos e outros programas ocupam a RAM.

  1. Feche navegador, jogos e Discord e tente de novo.
  2. Se não resolver, reinicie o PC e rode o comando antes de abrir outros programas.
  3. Se continuar, escolha um modelo menor da tabela, com a tag.

10. Baixou a versão grande sem querer

Sem mensagem. O download fica enorme, ou a IA lenta, porque você rodou um nome sem tag, como ollama run gemma4. Cancele com Ctrl+C e veja o que ficou salvo.

PowerShell
ollama list

A versão sem tag aparece com :latest. Apague pelo nome exato e baixe a certa, com a tag.

PowerShell
ollama rm gemma4:latest

Outros caminhos

App do Ollama. Desde a versão 0.10 (julho de 2025), o Ollama para Windows traz um app com janela de chat, que aceita arrastar imagens. Ele vem com a instalação. Se não aparecer, baixe em ollama.com/download/windows. Os modelos servem para os dois.

Outros programas. Existem alternativas ao Ollama, como o LM Studio, que tem tela gráfica, e o llama.cpp, mais técnico e às vezes mais rápido. Este guia não cobre esses caminhos, e o que você aprendeu aqui vale em todos eles. Memória da placa, tamanho do modelo, tag, provar que é a placa e medir.

Perguntas frequentes

É grátis mesmo?

Sim, sem cartão nem assinatura. Você gasta luz e disco. O modo turbo também é grátis, com limite diário.

Precisa de internet?

Só para instalar e baixar modelos, e para o modo turbo. Conversas e fotos funcionam offline, e o jogo salvo abre sem internet.

Gasta muita luz? Estraga a placa?

Enquanto a IA escreve, a placa trabalha como num jogo. Parada, gasta pouco. Não estraga mais que jogar. Ventilação livre e notebook sobre superfície dura. O nvidia-smi mostra temperatura e, em PC de mesa, os watts na coluna Pwr.

Funciona com AMD ou Intel?

A documentação de GPUs lista Radeon RX 7000 e PRO W7000 no Windows, e outras placas pelo Vulkan. Não confirmamos lista de Intel nem testamos essas marcas. Veja no ollama ps se aparece GPU.

E no Mac?

Segundo a documentação para macOS, precisa do macOS Sonoma (14) ou mais novo. Os comandos são praticamente os mesmos, no app Terminal, sem a parte de NVIDIA. Não testamos.

É igual ao ChatGPT?

Não. É menor, erra mais, não pesquisa na internet e lembra pouco. Em troca, é grátis, sem limite e nada sai do PC. Bicicleta e carro. A bicicleta é sua.

Como desinstalar tudo?

  1. Apague cada modelo com ollama rm e o nome do ollama list.
  2. Desinstale em Configurações, Aplicativos, Ollama.
  3. Abra a pasta com o comando abaixo. Se ela existir, pode apagar. Se o jogo.html existir, apague também com Remove-Item "$HOME\jogo.html".
PowerShell
explorer "$HOME\.ollama"

Próximos passos

Você instalou, conversou, mediu e criou. Mais que a maioria das pessoas que falam de IA na internet.

A aula em vídeo vai ao ar no canal @johnnyhelder-ia no YouTube e aparece nesta página. O vídeo seguinte repete tudo numa RTX 5060 de 8 GB, no PC do afilhado do Johnny. Bastidores e modelos novos saem primeiro no @johnnyhelder.ia no Instagram.

Compartilhe os seus números nos comentários, com este modelo.

Cole na conversa com a IA
Placa de vídeo e memória
Notebook ou PC de mesa
Modelo e tag
eval rate (média de 3 respostas)
O que o ollama ps mostrou
O português ficou bom? Nota de 0 a 10
Modo turbo, tentativas, tempo da resposta e tamanho do jogo.html

E ensine alguém. Quem ensina aprende duas vezes.

Fontes

Conhece alguém com um PC gamer parado?

Mande este guia para quem tem um computador com placa de vídeo em casa. Faça junto com os seus filhos e conte depois quantos tokens por segundo a sua placa fez.

Aulas em vídeo no YouTube @johnnyhelder-ia e bastidores no Instagram @johnnyhelder.ia.