Todo mundo quer soberania nacional em inteligência artificial. Só que ninguém faz a conta do ferro: a máquina de treinar sai US$ 95 mil lá fora e chega perto de R$ 1 milhão aqui. Eu tenho data center no Brasil e nos Estados Unidos — essa planilha quem assina sou eu.
Resposta rápida: o Brasil não treina a própria IA porque falta computador — e falta computador porque o imposto dobra o preço do equipamento. A estação de treinar da NVIDIA sai ~US$ 95 mil nos Estados Unidos e chega perto de R$ 1 milhão aqui; um nó de servidor com 8 GPUs H200 custa US$ 320 mil a 420 mil lá fora e passa de R$ 5 milhões aqui. Um rack com dez desses: R$ 50 milhões lá, R$ 100 milhões aqui. Nenhuma empresa faz isso por patriotismo — empresa não é caridade. Minha campanha é de duas letras: ou investe, ou isenta. E tem notícia boa desde a gravação: em 15/09/2026 o Brasil isentou (Lei 15.504/2026, o Redata) — com o texto citando treinamento de IA com todas as letras. Resolve parte da conta. Não resolve tudo, e eu explico onde ainda trava.
Gravei esses 13 minutos no canal @josimarjmv, publicados em 11 de julho de 2026. Assista e leia junto: aqui embaixo eu refaço a conta com os preços conferidos e trago quatro apurações minhas feitas em 24/09/2026 — inclusive uma que me corrige e outra que responde a campanha que eu levantei na gravação.
🎧 PREFERE OUVIR? · 14 min
Este artigo também é um episódio do podcast Josimar JMV | Em Produção — o mesmo vídeo, só o áudio, normalizado pra fone.
Vou dar minha carteirada antes, porque esse assunto virou papo de comentarista. Eu tenho uma empresa de tecnologia de verdade — empresa que existe, que tem suporte, que tem venda, que tem folha pra pagar. Eu transito em todos os setores dela e sou hands-on na parte técnica: eu desenvolvo, eu cuido de infraestrutura que entrega milhões de views todo dia, com CDN no Brasil e nos Estados Unidos.
Então quando eu falo de comprar GPU, montar rack e pagar imposto de importação, não é palpite: é a planilha que eu assino no quinto dia útil. Eu já contei aqui por que migrei da nuvem pro on-premise e o que aprendi comprando bloco de IPv4 no mercado — é o mesmo tipo de conta, com outro número na ponta.
Quando eu falo treinar o modelo, quem é mais cru pode achar que é pegar um monte de PDF e jogar numa IA pra ela entender — tipo aqueles cadernos inteligentes onde você sobe documento e pergunta em cima. Não é isso. Isso é o modelo lendo o seu documento na hora da pergunta.
Quem já fez fine-tuning entende melhor. E quem já foi um nível abaixo — pegar um modelinho no Hugging Face e ir mandando documento padronizado — sabe que é chato pra caramba. Hoje abstraíram muita coisa, mas continua chato: você gasta um tempo enorme achando o padrão pra seguir, refinando e afinando. E eu não vou entrar em detalhe técnico demais, porque nessa área específica eu não sou o cara mais técnico da sala e não vou vir aqui comer de conversa. Sei alguma coisinha porque eu já fiz, eu faço, e tenho o desejo de um dia ter um trem mais cabuloso no meu data center pra isso.
Agora vem a parte que eu conheço de cabo a rabo: quanto custa o ferro.
Saiu a DGX Station da NVIDIA, com o superchip GB300 e NVLink. Na gravação eu falei "entre 90 e 100 e poucos mil dólares" — e eu fui conferir.
Apuração minha, feita em 24/09/2026: a DGX Station é vendida pelos parceiros de sempre (HP, Dell, Supermicro, Asus, Gigabyte, MSI) e foi listada por cerca de US$ 94.930, com configurações passando de US$ 190 mil. Ou seja: a minha conta de cabeça estava certa.
Esse negócio eu nem pesquisei preço no Brasil ainda, mas eu sei como funciona: chega aqui uns 800 mil reais, 1 milhão, fácil. E não é exagero meu, é o padrão do mercado de equipamento importado — uma H na Dell sai 250 mil quando você acha a mesma coisa por 150 mil em outro lugar. É assim que esse mercado opera aqui.
Guarda esse detalhe: isso é um desktop. É a máquina pra você começar a brincar — e eu falo "brincar" no sentido bem sério.
Se você quer coisa de data center, não é desktop: é SXM — aquele soquete em que a GPU gruda na placa-mãe igual processador. Uma placa-mãe com 8 GPUs H200 — e olha que eu falei do H "na humildade", os caras estão no H200 — sai por uns US$ 400 mil.
Apuração minha (24/09/2026): a NVIDIA não publica tabela de preço de HGX, mas o levantamento de mercado para 2026 põe o nó de 8 GPUs H200 entre US$ 320 mil e US$ 420 mil, com US$ 370 mil como valor típico de OEM. De novo, a conta que eu fiz de cabeça bate.
E aqui no Brasil? Se você conseguir muito barato, paga 3 milhões de reais num negócio desses. Mais imposto: 5, 6 milhões. E ninguém monta data center com um servidor só: um rack tem 42, 44 unidades. Se cada servidor ocupa quatro unidades, você bota dez. Dez nós comprados lá fora: uns R$ 50 milhões. Comprados aqui: R$ 100 milhões.
Antes de você me dizer "então o governo compra", eu preciso te contar uma história. Eu estive lá dentro, eu vi, eu conversei com as pessoas.
A gente prestou serviço pra uma empresa pública enorme, no estado de São Paulo, que fazia transmissão de aula ao vivo. Eles abriram licitação e colocaram no edital uma mesa de som de R$ 220 mil. Pra transmitir aula. Overkill total e absurdo.
E o pior nem é o preço. O pior é que, tendo comprado um equipamento desse porte, alguém ali teria que extrair todos os recursos daquilo pra fazer diferença. Não sabia. Ninguém sabia. Conseguiram uma verba, e verba tem que ser gasta — "não é meu dinheiro, vamos torrar".
Não estou dizendo que são todos, longe disso. Mas de vez em quando aparece um aventureiro que pega um edital, uma verba, compra um troço de 800 mil reais — e depois olha pro equipamento e pergunta: "e agora, o que eu faço?". Comprar GPU sem gente que saiba treinar modelo é exatamente isso, com um zero a mais.
Mesmo com dinheiro na mão, comprar tem teto. O governo americano bota limite no que você compra da NVIDIA. Na gravação eu falei de cabeça em "mil GPUs, uma coisa assim" — e aqui eu preciso ser honesto com você: esse número exato eu não confirmei.
O que eu confirmei, apuração minha de 24/09/2026, é melhor do que o número solto: em 15 de janeiro de 2025 os Estados Unidos publicaram a regra de difusão de IA, que dividia o mundo em três faixas e limitava quanta capacidade de computação podia ser instalada fora do grupo de aliados — com teto por país para quem estava na faixa do meio, que é onde o Brasil cairia. Essa regra foi revogada em maio de 2025, dias antes de entrar em vigor, e no lugar dela ficou licenciamento caso a caso e acordo país a país.
E olha o que isso significa na prática pra quem planeja compra: antes o teto era um número publicado; agora é uma negociação. Pra mim, que preciso dizer ao banco quanto vou investir e em quanto tempo, imprevisível é pior que restrito. Virou negócio estratégico de Estado — nova Guerra Fria, com placa de vídeo no lugar do míssil. É a mesma lógica que eu já discuti quando falei do cabo submarino e da soberania de dados: o que passa por fora do país, um dia, alguém fecha.
Sai notícia toda hora: o Brasil vai investir tanto em data center. E eu pergunto sem ironia: com quem? Pega o secretário de economia, pega o presidente, pega o responsável por tecnologia do governo. Você bota fé que esse projeto anda?
Eu tenho um exemplo pequeno e perfeito. Na minha cidade, anunciaram uma cidade tecnológica — num pasto. Fui ver quem estava encabeçando: nenhum dono de empresa de tecnologia da cidade foi chamado. Ninguém. Você acha que vai pra frente? Não vai.
Agora, justiça é justiça, e eu não vim falar besteira do setor público sem checar. Apuração minha (24/09/2026): o supercomputador Santos Dumont, do LNCC, recebeu uma ampliação anunciada em julho de 2025, como primeiro aporte do Plano Brasileiro de Inteligência Artificial — que prevê R$ 23 bilhões em quatro anos. O equipamento foi a 18,85 petaflops, 575% acima da configuração de 2015, com 248 GPUs H100, 144 superchips Grace Hopper e 36 APUs MI300A.
Isso é dinheiro de verdade e trabalho sério — eu reconheço. Mas repara no tamanho: 248 H100 é o equivalente a uns 31 daqueles nós de 8 GPUs. É um belo parque de pesquisa, dividido entre projetos acadêmicos do país inteiro. Não é capacidade que a minha empresa, ou a sua, pega pra treinar um modelo. E é aí que eu volto pro meu ponto: o setor público sozinho não consegue. Quando esse negócio anda, é PPP — público e privado. Você tem que ouvir quem mexe com isso todo dia, e o setor público tem que entrar subsidiando.
É simples e cabe em duas letras: I.I. — investe ou isenta.
Um dos dois. Porque, do jeito que estava quando eu gravei, não tinha nada que justificasse eu botar esse equipamento no Brasil. Um equipamento de US$ 4 milhões que eu ponho no meu data center nos Estados Unidos custaria R$ 7, 8, 9 milhões pra ficar aqui. Dobra o preço. Aí quem tem capital leva pra Portugal, leva pros Estados Unidos, deixa lá.
E não adianta vir com romantismo: empresa é feita pra dar dinheiro, não é caridade. Soberania nacional que não fecha na planilha não sai do PowerPoint.
Eu falei isso na gravação de 11/07/2026: "se quando você vê esse vídeo o governo tiver feito alguma coisa, ótimo". Pois é — fez. E eu não vou esconder de você só porque contraria o meu discurso de julho.
Em 15 de setembro de 2026 foi sancionada a Lei 15.504/2026, que criou o Redata, o regime especial de tributação para data center. Ele suspende Imposto de Importação, PIS/Cofins, PIS/Cofins-Importação e IPI na compra de equipamento por cinco anos, virando isenção definitiva quando a empresa cumpre as contrapartidas. A renúncia estimada é de R$ 5,2 bilhões em 2026.
E tem o detalhe que interessa exatamente a esta conversa: o texto lista treinamento e inferência de modelos de inteligência artificial entre os serviços beneficiados. Ou seja: GPU de treinar IA entrou. Eu li o projeto emenda por emenda e escrevi tudo em o que o Redata isenta e o que ele exige em troca — leia antes de comemorar, porque as contrapartidas são pesadas: 10% da capacidade ao mercado interno, 2% do valor comprado em P&D, energia limpa, teto de água no resfriamento — e Simples Nacional está vedado.
O que a isenção NÃO resolve: ela baixa o custo de comprar — e isso é enorme, era metade da minha campanha. Só que a outra metade continua de pé: quem compra é quem já tem porte pra cumprir contrapartida de energia, água, P&D e mercado interno. A empresa pequena que queria treinar o modelo dela continua fora, e o pesquisador continua na fila do supercomputador público. Isenção sem acesso não vira soberania, vira data center de multinacional hospedado aqui — que é outra coisa, e nem é ruim, mas não é a nossa IA.
Na gravação eu disse que não temos nada treinado pra nossa cultura, pro nosso jeito, pra nossa justiça. Apuração minha (24/09/2026), e ela me corrige em parte: temos, sim, iniciativas de verdade. A Maritaca AI mantém a família Sabiá, treinada com foco em português e contexto brasileiro, e a WideLabs lançou o Amazônia IA, também em português. Isso não é papagaiada, é gente treinando modelo.
O que eu não retiro é a bronca com anúncio de "IA nacional" que é só uma casca colorida em cima de modelo dos outros. Isso me dá vontade de enfiar a cabeça no chão de vergonha — porque queima o assunto sério e faz o país inteiro parecer amador.
E o que o Sabiá e o Amazônia confirmam é justamente a minha tese: eles existem apesar da falta de parque nacional de GPU, não por causa dele. Nós somos um país continental — tem pelo menos cinco países aqui dentro, cada um com sua cultura, seu jeito, seu sotaque. Pequi, mandioca, macaxeira: é a mesma raiz e três palavras diferentes. Tem mercado enorme pro Brasil ter o dele — e dá pra começar pegando um bom modelo aberto no Hugging Face e fazendo o nosso fork, o nosso ajuste.
Falta capacidade técnica? Não falta. O brasileiro tem que ser estudado pela NASA: somos criativos e inteligentes pra caramba. Não são todos — tem os preguiços e os chinelinhos, e você achou mesmo que eu ia deixar passar depois de ter escrito que acabou a era do dev chinelinho? Mas a maioria é gente boa e batalhadora, e cabeção aqui tem de sobra.
O problema é outro: pra tocar uma treta dessas eu preciso contratar sênior. O gringo paga 150 mil de júnior; aqui, o que vira custo de uma CLT é comparável. É por isso que holding grande de tecnologia está indo pra fora, abrindo CNPJ em cada país, e contratando PJ de fora pro Brasil — mais atrativo pra quem trabalha, mais atrativo pra quem contrata. Eu não estou defendendo, estou descrevendo o que acontece.
Junta as duas contas — equipamento que dobra de preço e folha que pesa — e você entende por que o projeto de IA brasileira nasce fora do Brasil. Não é falta de patriotismo. É aritmética.
Não adianta falar "vou ligar minha 5090 aqui e treinar". Não dá, velho. Pra treinar algo que vá pro mercado, você precisa de volume grande de dados e de parque de GPU — não de uma placa boa.
A soberania que a gente tem hoje, na prática, é: baixar um modelo aberto, rodar local — numa 5090, num Mac Mini, num H100 se alguém tiver — e fechar ali dentro. Isso é privacidade, e não é pouca coisa: o dado não sai de casa. É a mesma lógica de quando eu mostrei como parar de pagar VM na nuvem rodando Proxmox no seu próprio ferro. Só que o modelo continua sendo dos outros.
Soberania mesmo é ter modelo treinado pro nosso jeito, pra nossa justiça, pra sua empresa e pra minha. E eu falo isso como quem tem ambição de estourar um produto meu no mundo inteiro — hoje eu já tenho cliente em 18 países, mas é pouquinho ainda: cinco aqui, dez ali, vinte ali, e a esmagadora maioria no Brasil. A gente tem capacidade de lançar algo global com o pé nas costas. Falta o ferro.
O Brasil quer IA. O Brasil tem gente. O Brasil não tem computador. Ou investe, ou isenta — e agora que isentou, falta abrir o acesso. Se você tem, ou conhece quem tenha, parque de GPU de treinamento rodando no Brasil, me conta: eu quero estar errado nessa.
TODA SEGUNDA · MEIO-DIA · AO VIVO
Discorda? Concorda? Tem um caso parecido? Aqui não tem caixa de comentário de propósito: segunda-feira, ao meio-dia, eu faço live no canal e a gente conversa sobre isso ao vivo — sem corte, como sempre.
"Josimar, e como é que eu monto a minha estrutura, então?" Aí a gente sai da política e entra no que eu sei fazer: rack, energia, rede, redundância, o caminho das pedras de quem já apanhou. Eu não passo 20 anos de operação em poucos dias, isso não existe — mas eu consigo te entupir a cabeça do que fazer: o que eu errei, o que eu acertei e o que eu uso hoje. É disso que eu trato nas minhas imersões, cada uma na sua página. Abraço, e até a próxima.
Baseado na gravação do canal @josimarjmv publicada em 11/07/2026 (13min40), com transcrição própria das legendas do próprio vídeo. São da minha vivência e foram ditos na gravação: ser CEO hands-on de uma empresa de tecnologia com suporte, venda e operação, cuidando de infraestrutura de milhões de views por dia com CDN no Brasil e nos Estados Unidos; a diferença entre treinar modelo, fazer fine-tuning e subir documento para um modelo já pronto, e a experiência com modelos do Hugging Face; a estimativa de 90 a 100 e poucos mil dólares para a DGX Station com GB300 e a projeção de 800 mil reais a 1 milhão aqui; a comparação de uma placa da linha H a 250 mil na Dell contra 150 mil em outro lugar; a estimativa de US$ 400 mil para uma placa com 8 GPUs H200 em SXM, de 3 milhões de reais no Brasil e 5 a 6 milhões com imposto, e a conta do rack de 42 a 44 unidades com dez servidores a R$ 50 milhões lá fora contra R$ 100 milhões aqui; o equipamento de US$ 4 milhões que custaria R$ 7 a 9 milhões para ficar no Brasil; o caso da empresa pública do estado de São Paulo que licitou uma mesa de som de R$ 220 mil para transmissão de aula ao vivo sem ter quem soubesse operar, que eu presenciei; a existência de limite do governo americano para a compra de GPU; a crítica ao anúncio de "IA nacional" que não se sustenta; a defesa de um modelo ajustado à cultura brasileira num país continental; o caso da cidade tecnológica anunciada na minha cidade sem chamar nenhum dono de empresa de tecnologia local; a campanha "investe ou isenta" e a defesa de PPP; o custo de contratar sênior, o gringo pagando 150 mil de júnior e a migração de holdings com CNPJ em vários países contratando PJ; e ter cliente em 18 países. É apuração minha, feita em 24/09/2026, e não estava na gravação: o preço listado de US$ 94.930 para a DGX Station e a disponibilidade pelos parceiros na página do produto na NVIDIA; a faixa de US$ 320 mil a US$ 420 mil para o nó de 8 GPUs H200, com US$ 370 mil como valor típico — levantamento de mercado, já que a NVIDIA não publica tabela de HGX; a regra de difusão de IA publicada em 15/01/2025 com três faixas de países e teto por país, revogada em maio de 2025 antes de vigorar e substituída por licenciamento caso a caso; a ampliação do supercomputador Santos Dumont anunciada em julho de 2025 para 18,85 petaflops, com 248 GPUs H100, 144 Grace Hopper e 36 APUs MI300A, dentro do Plano Brasileiro de Inteligência Artificial de R$ 23 bilhões em quatro anos; a sanção da Lei 15.504/2026, o Redata, em 15/09/2026, com suspensão de Imposto de Importação, PIS/Cofins, PIS/Cofins-Importação e IPI, renúncia estimada de R$ 5,2 bilhões em 2026 e menção expressa a treinamento e inferência de IA; e a existência dos modelos brasileiros Sabiá, da Maritaca AI, e Amazônia IA, da WideLabs. Ressalvas: o limite de "mil GPUs" que eu citei de cabeça na gravação não foi confirmado em fonte oficial — o que se confirma é a existência de cota por país na regra de 2025, hoje revogada. Os valores em real deste texto são estimativa minha de operador, com imposto e margem de revenda, e variam por fornecedor, câmbio e volume — não são tabela oficial de ninguém. E a afirmação de que "não temos nada treinado pra nossa cultura", que eu fiz na gravação, está corrigida no corpo do texto: existem modelos brasileiros em produção, o que não existe é parque nacional de GPU na escala necessária.