A conta fechou em R$ 9.989,76. É o que custa hoje, com preço de loja conferido peça por peça, um PC que roda modelos de linguagem em casa com 16 GB de memória de vídeo e banda de sobra para não engasgar. A versão enxuta, que eu monto no final, sai por R$ 7.463,75.
Antes que você feche a aba: uma placa profissional com 24 GB ou mais custa múltiplos disso, e é exatamente o que a maioria dos tutoriais gringos assume que você tem. A proposta aqui é a faixa em que o hardware de consumidor entrega o suficiente.
E tem um detalhe que ninguém do nicho está falando: nessa build, memória RAM e SSD somados custam R$ 3.168,22. Isso é 32% do orçamento em duas peças que todo guia trata como detalhe de rodapé. A regra de "reserve metade do orçamento para a placa de vídeo" morreu junto com o preço antigo da DRAM.
O que realmente limita IA local (e não é o que você pensa)
Inferência de modelo de linguagem é um problema de memória, não de poder de cálculo. Para cada palavra que o modelo escreve, ele varre os pesos inteiros que estão na VRAM. Isso significa que duas coisas mandam no resultado: quanto cabe na placa e com que velocidade ela lê o que cabe.
Por isso 16 GB é o número mágico de 2026. Em quantização Q4, que é o padrão prático de quem roda em casa, um modelo de 7 ou 8 bilhões de parâmetros ocupa por volta de 5 GB. Um de 12 a 14 bilhões fica na casa dos 8 a 9 GB. Um MoE de 20 bilhões chega perto de 12 GB. Todos cabem com folga para o contexto crescer. Um modelo de 30 a 32 bilhões pede algo entre 18 e 20 GB, transborda para a RAM do sistema e a velocidade de geração cai de um jeito que você sente no dedo.
Com 8 GB você fica preso na primeira faixa e o contexto longo já começa a doer. Uma placa de 8 GB mais rápida perde para uma de 16 GB mais lenta em quase todo cenário de IA, mesmo ganhando em jogo. Essa inversão é o ponto mais importante do texto.
A segunda variável, que é onde a 9070 XT ganha o artigo
Largura de banda. Aqui a diferença entre as opções de 16 GB deixa de ser detalhe e vira o número que decide.
A Radeon RX 9070 XT usa barramento de 256 bits com GDDR6, o que coloca a banda na casa de 640 GB/s. A GeForce RTX 5060 Ti de 16 GB usa 128 bits com GDDR7 e fica por volta de 448 GB/s. São cerca de 40% a mais para a AMD, e num trabalho em que o gargalo é literalmente ler memória, essa vantagem tende a aparecer quase na proporção na velocidade de geração de texto.
Guarde isso, porque muda a conversa. A escolha entre AMD e NVIDIA para IA local em 2026 não é mais "a rápida contra a barata". É banda contra ecossistema.
O software: Ollama, LM Studio e o resto
Essa parte é de graça, e é a parte que mudou o jogo. Três anos atrás rodar um modelo local exigia paciência com Python, CUDA toolkit e requirements quebrados. Hoje são dois cliques.
Ollama é o caminho de quem gosta de terminal e quer o modelo virando serviço. Você instala, digita ollama run seguido do nome do modelo, ele baixa e abre um chat. Melhor que isso: ele levanta uma API local compatível com o formato da OpenAI, o que faz qualquer ferramenta que você já usa apontar para a sua máquina em vez de apontar para a nuvem. É o que eu usaria para automação e integração. O incômodo é que a interface é o terminal, então quase todo mundo acaba instalando o Open WebUI em cima para ter uma tela decente.
LM Studio é o oposto e provavelmente a sua escolha se está começando. É um aplicativo de janela, com catálogo de modelos, controle de quantas camadas vão para a GPU e um medidor que mostra quanto o modelo escolhido vai ocupar antes de você baixar. Ele também expõe servidor local. O ponto que interessa aqui: o LM Studio traz motores de execução diferentes, incluindo o caminho Vulkan, e isso torna a vida de quem tem placa AMD muito mais simples do que a fama do assunto sugere. O defeito é ser fechado, e você fica na mão do calendário deles quando aparece arquitetura nova.
Debaixo dos dois está o llama.cpp. Vale saber que ele existe porque é onde as coisas aparecem primeiro e é a saída quando o app bonito não reconhece seu hardware.
Para imagem, o ComfyUI é o padrão de quem quer controle real sobre o processo. Aviso honesto: aqui o ecossistema é claramente inclinado para NVIDIA, e é o principal motivo para você não escolher a Radeon se geração de imagem faz parte do plano.
Setup A: Radeon RX 9070 XT 16 GB
Esta é a build que eu recomendo para quem vai rodar modelo de texto de verdade, com contexto grande e sessão longa. Todos os preços foram conferidos hoje, 10 de agosto de 2026, no comparador do AchaPromo.
| Peça | Modelo | Loja | Preço |
|---|---|---|---|
| Processador | AMD Ryzen 5 5500 (AM4, 6C/12T) | Kabum | R$ 589,99 |
| Placa-mãe | MSI B550M-A PRO, DDR4, M-ATX | Kabum | R$ 655,00 |
| Placa de vídeo | Gigabyte RX 9070 XT Gaming OC 16 GB | Pichau | R$ 4.899,99 |
| Memória | Corsair Vengeance 32 GB (2x16) DDR4 3200 | Mercado Livre | R$ 1.799,00 |
| SSD | Kingston NV3 1 TB, M.2 2280, PCIe 4.0 | Magazine Luiza | R$ 1.369,22 |
| Fonte | Husky Sledger 850 W, 80 Plus Gold, full modular | Magazine Luiza | R$ 546,57 |
| Gabinete | Husky Dome 100, Mid Tower, ATX | Kabum | R$ 129,99 |
| Total | R$ 9.989,76 | ||
A placa de vídeo, e onde comprar ela
A versão Gaming OC está a R$ 4.899,99 na Pichau, e é a 9070 XT mais barata que apareceu no levantamento. A irmã sem overclock de fábrica, a Gigabyte RX 9070 XT Gaming, está em R$ 5.299,99, contra mínimo histórico de R$ 5.199,99 registrado em 1 de junho de 2026 e média de 90 dias idêntica ao preço de hoje. Preço parado há três meses, sem prêmio de urgência embutido.
Agora o número que justifica usar comparador: essa mesma Gigabyte Gaming, mesmo código de fabricante, está a R$ 6.999,98 na Kabum. São R$ 1.699,99 de diferença pela placa idêntica, dependendo apenas de onde você clica. Isso paga a fonte, o gabinete, o processador e a placa-mãe da build inteira, com troco. Se você levar uma única lição daqui, leve essa: abra o histórico antes de fechar o carrinho, porque a variação entre lojas no Brasil é maior que a diferença entre modelos.
O defeito real da 9070 XT não é preço nem banda, é software. O suporte a RDNA 4 no ROCm amadureceu bastante em 2025 e 2026, mas continua sendo a parte do setup que mais dá trabalho no Windows. O caminho Vulkan, tanto no llama.cpp quanto no LM Studio, funciona sem drama e é o que eu usaria. Só que "funciona sem drama para LLM" não é o mesmo que "funciona para tudo". Assim que você sai de texto e entra em geração de imagem, transcrição de áudio ou qualquer biblioteca de pesquisa, volta a valer a regra velha de que metade dos tutoriais assume CUDA.
A jogada de quem só quer texto: pegar a 9070 sem o XT
Essa é a recomendação que você não vai achar em outro guia, e ela sai direto da tabela de especificações. A Gigabyte RX 9070 Gaming de 16 GB custa R$ 4.259,99 na Pichau, R$ 640,00 menos que a XT.
Ela tem os mesmos 16 GB, o mesmo barramento de 256 bits e, portanto, praticamente a mesma largura de banda. O que a AMD cortou foram unidades de cálculo, que é justamente o recurso que fica ocioso quando o gargalo é ler memória. Em jogo a diferença aparece. Em geração de texto, ela encolhe muito. Se o seu plano é rodar Ollama e nada mais, esses R$ 640,00 são melhor gastos indo de 16 GB para 32 GB de RAM do sistema.
Nessa configuração o total cai para R$ 9.349,76.
As peças que ninguém olha e que carregam um terço da conta
Memória. É o item mais caro depois da GPU e o que mais mudou de patamar. O kit G.Skill Trident Z Neo de 32 GB DDR4 3600 está em R$ 1.951,44, que é o mínimo histórico dele e também a média de 90 dias, sinal de que o preço travou nesse nível. Para você ter noção do estrago: um anúncio equivalente registrou R$ 1.495,45 em novembro de 2025 e hoje está marcado em R$ 4.914,96 na Amazon. Na tabela eu usei o kit Corsair Vengeance de 32 GB por R$ 1.799,00, o mais barato dessa capacidade que apareceu no levantamento, com a ressalva óbvia de que é anúncio de marketplace e vendedor merece checagem.
Se você está pensando em DDR5 e plataforma AM5, olhe antes: um kit de 32 GB DDR5 6000 aparece a R$ 4.249,00. Mais que o dobro do DDR4. É o motivo central de eu ter montado tudo em AM4 num artigo escrito em 2026.
Armazenamento seguiu o mesmo caminho. O Kingston NV3 de 1 TB sai por R$ 1.369,22. Ele não tem cache DRAM, então gravação sustentada cai depois de um tempo. Aqui isso quase não importa: guardar modelo é carga de leitura, você baixa uma vez e lê mil vezes. É um defeito real que não te atinge nesse uso.
O Ryzen 5 5500 está a R$ 589,99 na Kabum. O mesmo processador, mesma caixa, aparece a R$ 738,43 no Pontofrio, nas Casas Bahia e no Extra. R$ 148,44 de diferença por nada. Ele é limitado a PCIe 3.0 e tem 19 MB de cache, e isso seria problema sério numa build de jogo. Aqui não é: depois que o modelo está carregado na VRAM, o barramento fica praticamente ocioso. Comprar o 5600XT por R$ 1.298,00 só para rodar IA é jogar R$ 708,01 fora. Se jogo entra no plano junto com uma 9070 XT, aí sim vale subir de processador, e o artigo muda de tema.
Na placa-mãe, a MSI B550M-A PRO por R$ 655,00 na Kabum entrega o que essa build precisa. Antes de fechar, confira quantos slots M.2 a sua revisão traz, porque nessa faixa é comum vir só um, e Wi-Fi não vem em nenhuma delas.
A fonte precisou subir, e isso é bom
A 9070 XT puxa muito mais que uma placa de entrada, e uma fonte de 650 W deixa de ser escolha razoável. Por isso a build usa a Husky Sledger de 850 W, 80 Plus Gold e full modular, por R$ 546,57 no Magazine Luiza, contra R$ 558,99 na Kabum.
Não encare isso como custo extra, encare como a peça que abre a porta seguinte. Com 850 W Gold no gabinete, você tem folga real para colocar uma segunda placa de 16 GB no futuro e chegar a 32 GB de VRAM total, que é o degrau em que modelos de 30 bilhões de parâmetros passam a rodar inteiros. Poucas builds nessa faixa de preço deixam essa porta aberta.
O gabinete é o Husky Dome 100 por R$ 129,99, com média de 90 dias igual ao preço de hoje. Ele aceita GPU de até 350 mm, o que cobre a 9070 XT, mas vem sem nenhuma ventoinha e tem vidro na frente, o que é ruim para fluxo de ar. Reserve mais uns R$ 60,00 para duas fans de 120 mm. Uma máquina gerando texto por vinte minutos seguidos fica em carga constante, diferente de jogo.
Setup B: GeForce RTX 5060 Ti 16 GB
Aqui a conta inverte em relação ao que você esperava. A MSI Ventus 2X Black Plus OC de 16 GB está a R$ 4.059,99 na Pichau, que é simultaneamente o mínimo histórico e a média dos últimos 90 dias. Com ela, a fonte de 650 W volta a servir, e o total da build cai para R$ 8.920,18.
Ou seja: a opção NVIDIA agora é a mais barata, e é a mais lenta em geração de texto. Você paga R$ 1.069,58 menos e recebe cerca de 40% menos largura de banda, em troca de CUDA e de um ecossistema em que tudo simplesmente funciona no primeiro try. Para quem vai gerar imagem, transcrever áudio ou seguir tutorial de pesquisa sem adaptar nada, esse é o dinheiro melhor gasto do artigo.
O que eu não faria de jeito nenhum: cair na armadilha do nome. A mesma MSI Ventus 2X, na versão de 8 GB, custa R$ 2.799,99, e a RTX 5060 comum de 8 GB sai por R$ 2.399,99. Economia de até R$ 1.660,00 que corta pela metade o tamanho de modelo que você consegue rodar. Para jogo em 1080p seria discussão legítima. Para IA local, é a compra errada.
A versão enxuta: R$ 7.463,75
Pegue a 9070 sem XT por R$ 4.259,99, volte para a fonte de 650 W, troque o SSD pelo Kingston NV3 de 500 GB a R$ 712,79 e a memória por um módulo único de 16 GB, o G.Skill Ares 3200 por R$ 799,00.
O SSD menor é concessão tranquila: você guarda três ou quatro modelos em vez de dez, e modelo baixado é fácil de apagar. Os 16 GB de RAM em pente único são a parte que eu não gosto, porque você perde dual channel e fica sem espaço para experimentar modelo grande com descarga parcial na CPU. Se sobrar orçamento em qualquer linha, é para cá que ele vai.
Qual das duas, no fim
Se o seu uso é chat de texto, assistente de código, resumo de documento e automação via API local, vá de Radeon. A banda de 256 bits é a vantagem mais concreta que existe nessa faixa de preço e a 9070 sem XT entrega quase tudo isso por R$ 640,00 menos que a XT.
Se imagem, áudio ou qualquer coisa fora de LLM entra na conta, vá de GeForce e economize R$ 1.069,58 no processo. Você vai perder velocidade de geração de texto e vai ganhar tempo que não será gasto caçando solução em fórum.
Nos dois casos, o número que mais importa antes de clicar não está na caixa da placa: está na diferença de R$ 1.699,99 que a mesma Gigabyte tem entre uma loja e outra. Abra o histórico da peça que você escolheu, compare as lojas listadas e compre na mais barata. Qual das duas você levaria, sabendo que a AMD é mais rápida no texto e a NVIDIA é mais tranquila em todo o resto?
Preços conferidos em 10 de agosto de 2026 no comparador do AchaPromo. Preço de hardware no Brasil muda toda semana: confira o histórico de cada peça e compare as lojas antes de fechar a compra.
