Eu me calei sobre esse assunto por anos porque eu queria fazer acontecer antes de abrir a boca. Em julho de 2026 aconteceu aqui dentro: criei a issue, a IA desenvolveu a feature, validou no sandbox, subiu e me avisou que estava pronta no QA. E o que destravou não foi o modelo — foi eu parar de dar pra ela a mesma instrução que eu dou pra gente.
Resposta rápida: em julho de 2026 eu consegui, pela primeira vez, uma IA ocupando a casa de um dev júnior dentro do meu pipeline real de produção — não achando bug, não escrevendo teste, mas fechando a issue do começo ao fim: desenvolveu, validou no ambiente de sandbox, subiu e me avisou quando estava pronta pro QA. Fiz isso repetidamente, não uma vez, pra ter certeza de que não era sorte. A chave não foi o modelo — foi uma mudança de instrução: pra um humano eu escrevo "se achar algo simples pra melhorar no caminho, resolve"; pra IA essa frase é veneno, porque ela começa a inovar demais. IA trabalha com escopo fechado, issue detalhada, padrão de código (SOLID, MVC) e bloqueio no CI — regra escrita em arquivo de instrução, sozinha, não segura produção complexa. O que não mudou: eu continuo não pondo infraestrutura na mão da IA, e o QA humano mais o sênior conferindo o diff ficaram mais necessários, não menos.
Gravei esses 20 minutos no canal @josimarjmv em 16 de julho de 2026, logo depois do fim de semana em que isso funcionou. Assista e leia junto: aqui embaixo eu conto a mesma coisa com mais calma, com duas datas que eu fui conferir depois — e numa delas eu estava errado.
🎧 PREFERE OUVIR? · 20 min
Este artigo também é um episódio do podcast Josimar JMV | Em Produção — o mesmo vídeo, só o áudio, normalizado pra fone.
Vou dar minha carteirada antes, senão isso vira só mais um texto de gente repetindo manchete. Eu sou dono de uma empresa de tecnologia e administro data center no Brasil e nos Estados Unidos. E o detalhe que muda tudo nessa conversa: eu tenho folha de pagamento. No quinto dia útil eu tenho que pagar a conta de todo mundo e olhar se a empresa deu lucro ou não.
Eu coordeno o fluxo inteiro, por setor. Tem a parte física de verdade — ir lá botar HD, SSD, NVMe, processador, memória, cabo de 10 GB, fibra, roteador. Tem a turma de telecom. Tem a infraestrutura que entrega a base pros desenvolvedores rodarem as aplicações. Tem o desenvolvimento, onde eu hoje não trabalho com front separado: é sempre full stack. Tem mobile, que aqui é equipe à parte, pessoa diferente. E na ponta tem os sites, o time de vendas e o de suporte.
Falo isso porque automatizar, pra mim, não é entusiasmo: é lucro. Quanto mais eu automatizo e elevo a qualidade, maior o lucro — isso é óbvio pra mim e pra qualquer um que tenha empresa. Só que pra chegar nesse nível dá trabalho. Eu vou te falar: dá trabalho. E eu venho tentando e aspirando isso há muito tempo.
Eu vi muita gente falando grosélia sobre substituição de programador por inteligência artificial nos últimos anos. Porque bolha, porque isso, porque aquilo. E pra não falar grosélia também, eu me abstive. Várias vezes. Por quê? Porque eu precisava fazer acontecer. Eu não vou confiar cegamente em alguém.
Tem um episódio que me marcou. Eu fiz cursos aqui no Brasil, inclusive de empresa muito grande que vende educação por aí, e o CTO deles estava dando o curso de IA. Eu fiz algumas perguntas que ele não conseguiu responder — saiu pela tangente. Isso gera uma desconfiança danada. Mas teve um efeito bom: ali, mais ou menos um ano atrás, eu vi que eu estava no caminho certo.
Então eu não estou romantizando pra nenhum dos dois lados aqui. É dado e é lógica. Se eu não tivesse feito, eu não estaria escrevendo.
Todo o tempo que eu passei tentando fazer coisa autônoma esbarrou no mesmo lugar. O agente é proativo de um jeito burro: ele quer colocar um monte de coisa que você não quer. E aí você vai criando gatilho no seu arquivo de regras pra prever o que ele pode fazer sem você pedir.
Só que pensa comigo: como é que eu vou, dentro de uma tarefa que eu acabei de escrever, listar tudo que não pode entrar no diff? "Não mexe nisso, nisto e naquilo." É muito difícil prever isso tarefa a tarefa. Se eu tiver que fazer isso, eu faço na mão e acabou.
O resultado prático era esse: eu gastava mais tempo corrigindo o que a IA fez por conta própria do que eu gastaria fazendo o trabalho. Enquanto a conta for essa, não existe ganho — existe teatro de ganho. E antes que perguntem: eu já tinha testado o que havia pra testar. Eu contei aqui como testei o Jules do Google e ele não serviu no meu pipeline, e também voltei a usar o Cursor e levei a equipe junto. Tinha o Devin, tinham os agentes que você integra no repositório. Nada disso chegava no nível de confiança que eu precisava pra fechar uma feature.
Escrever teste ficou fácil demais com IA, e é exatamente aí que mora o problema. Tem muita gente deixando a IA fazer teste como se não houvesse amanhã, arrebentando os créditos — e a pessoa nem sabe que teste é aquele que a IA escreveu.
Desenhar a matriz de teste que realmente precisa existir é um trabalho exaustivo mentalmente, e continua sendo humano. Depois que ela está desenhada, o resto você pode jogar fora. E não se iluda: nenhum sistema é coberto cem por cento por teste. Talvez sistema de banco — nunca trabalhei com banco, então não vou afirmar.
Pra você entender o que foi substituído, precisa ver onde. O fluxo aqui é assim, e ele existia muito antes de IA:
Eu entro nesse fluxo como dono e como apoio técnico de arquitetura — e às vezes o papel de produto é do próprio pessoal de vendas, que faz isso muito bem porque é quem recebe o pedido. Nada de exótico. Por sinal, eu já contei por que larguei a sprint clássica e story point não faz mais sentido com IA — mas a espinha do fluxo é essa.
Aqui está o pulo do gato, e é bem menos glamouroso do que as pessoas querem que seja.
Com um desenvolvedor humano, a minha issue sempre teve esta frase: "se no meio do caminho você encontrar alguma coisa que careça de melhoria e for simples, cria uma task interna e desenvolve; se não for, abre uma issue separada." Isso é bom com gente. Faz o profissional pensar, faz o sistema melhorar.
Essa instrução eu não posso dar pra IA. Se eu der, ela começa a inovar demais. A IA tem que trabalhar com escopo fechado: ela não vai alterar nada além do que está escrito. É só isso — e foi isso que virou a chave. Não foi um modelo mágico.
O outro lado da moeda é que a issue precisa ter um nível de detalhe que ela não pode ultrapassar, mas que basta pra ela executar. Eu passo mais detalhada e dentro de padrão: SOLID é fantástico pra usar com inteligência artificial, funciona muito bem pra mim. MVC como padrão. E o básico que quem entende de código já sabe: não criar arquivo de 20 mil linhas, por favor.
Dia de semana aqui o pau come, é muita coisa. Eu em geral pego pra mexer pra valer no fim de semana. E foi num fim de semana de julho de 2026 que eu criei a feature, entreguei na issue detalhada — regra de negócio, experiência do usuário, o que era esperado, o que não era pra acontecer.
E aí:
Isso é real, oficial. Ninguém me contou, eu não estou indo no hype de ninguém — nem de gente emocionada, nem de negacionista. Eu fiz acontecer, de uma forma que atende o que eu preciso pra botar em produção. E não foi uma vez: eu repeti, de propósito, pra ter certeza de que não era sorte de uma tacada.
Qual modelo eu usei? O Fable. E o que me interessou nele não foi benchmark: foi que a proatividade dele foi assertiva. Ele seguiu as minhas regras. Ele faz um loop bacana de rever as regras que eu pedi, independente de gasto. Antes que venha o "mas é caro": o gasto depende de você. Quem só consome e nunca teve uma folha de pagamento na mão enxerga esse custo de um jeito; quem paga a folha e entende tecnicamente enxerga de outro — eu já abri essa conta em bolha da IA e a conta do dev júnior.
Na gravação eu falei duas coisas de cabeça. Fui atrás das duas depois, e é justo eu te contar o resultado.
1) A confusão do lançamento do Fable — eu estava certo, e foi mais esquisito do que eu lembrava. Eu disse que lançaram "numa quarta, numa terça, sei lá, e na sexta baniram". Fui conferir: a própria Anthropic registra que o Fable 5 saiu na terça, 9 de junho de 2026, e que em 12 de junho — uma sexta — veio uma diretiva de controle de exportação do governo americano que obrigou a suspender o acesso. Os controles só foram derrubados em 30 de junho, e o modelo voltou pro mundo todo na quarta, 1º de julho. Por isso eu não peguei ele de cara: quando eu fui testar pra valer, ele tinha acabado de voltar e dado uma estabilizada.
2) O tanto de código escrito por IA — aqui eu errei o número. Eu falei de cabeça em "70, 80%, se não 100%", citando pesquisa da Anthropic e da Microsoft. Fui conferir e o número público é bem menor: o CEO da Microsoft disse que 20% a 30% do código nos repositórios da empresa foi escrito por IA — e isso foi em abril de 2025, num evento com o Zuckerberg. Ele ainda disse que o resultado varia por linguagem: mais avanço em Python, menos em C++. Fica o número certo, não o meu chute. O argumento não depende dele: o ponto é que a gente já não digita código como antes.
Agora a parte em que eu seguro a onda, porque senão isso aqui vira propaganda. Infraestrutura eu não boto na mão da IA. Não boto pra produção. Até hoje é um déficit muito grande.
O que eu faço é testar continuamente: a cada coisa eu pergunto, eu meço, eu vejo se ela está pronta pra assumir responsabilidade maior. E hoje ela não está. Pode ser que mude — e se mudar, eu conto aqui, como eu contei quando migrei da nuvem pro on-premise.
Outra coisa que eu observei ao longo de muito tempo, e que quase ninguém fala: a IA se dá melhor com determinado tipo de código e determinado tipo de stack. Isso importa mais do que escolher o modelo da semana. E tem modelo que eu simplesmente ainda não testei — o Grok 4.5 saiu, o pessoal falou bem, eu não testei, então eu não falo.
Aqui vai o alerta pro empresário: dá pra fazer isso hoje, mas não em todo projeto e não no fluxo inteiro. E tem um pré-requisito que não é ferramenta — é gente.
Você precisa de um tech lead. Um cara bom de verdade, que arquiteta o negócio e sabe puxar os fios dos agentes. Porque a issue que eu passei a escrever tem um grau de complexidade que a IA não pode ultrapassar e, ao mesmo tempo, o nível de detalhe que ela precisa pra executar. Quem escreve essa issue é esse profissional.
Na minha opinião é esse o perfil que as empresas vão querer, e é também o perfil de quem poderia empreender. Só que muita gente não quer — empreender envolve jurídico, financeiro, venda, um monte de coisa que a pessoa não domina e não quer dominar. E envolve lidar com gente, que é mais difícil do que lidar com IA. É um perfil, não é um destino. Por isso eu venho dizendo que o especialista estreito acabou e eu só contrato full stack.
E olha o contraste com os que se emocionaram: teve muito CEO e diretor que abraçou IA como se não houvesse amanhã e agora está fazendo rollback. Por que não fizeram o que eu fiz? Primeiro entender, primeiro botar a mão na massa, primeiro fazer funcionar — e só depois anunciar. Eu escrevi sobre esse tombo em o erro não foi a IA, foi o CEO emocionado.
Eu consegui isso em um projeto. Esse é o problema — porque eu tenho 300 projetos. E a solução é fazer a mesma coisa nos 300.
A conta que me convenceu é essa: o mesmo tempo que eu gasto treinando um júnior, eu gasto treinando a IA nos meus 300 serviços — serviços que muitas vezes não têm documentação completa, e tem coisa feita há mais de 10 anos, legado, que eu posso trazer. O tempo de treino é o mesmo. O que muda é o que acontece depois: o treinamento do júnior é outro, a vaga do júnior é outra. Isso é assunto que eu já tratei em apagão de dev júnior: eu também parei de contratar, e não vou repetir aqui.
Eu continuo rodando esse projeto hoje. Mando issue, o sistema puxa, desenvolve e me devolve. E eu vou ser honesto sobre o efeito colateral: ele me esgota mentalmente, porque desenvolve muito mais rápido do que um dev comum. Uma pessoa não dá pra competir nisso. É impossível.
Então o meu gargalo mudou de lugar. Hoje o meu problema é ter gente pra testar e sênior pra conferir o diff e ver se não tem besteira ali. Na minha cabeça, o que funciona é o mesmo fluxo humano de sempre: o agente desenvolve a feature, o QA confere a regra de negócio, o sênior confere o código. Nada que uma empresa normal já não faça.
E tem uma lição técnica que eu paguei pra aprender: ao longo do tempo a gente vai colocando bloqueio no CI. Porque só regra inviolável escrita no arquivo de instrução do agente não dá certo em ambiente de produção complexo. Não dá. A regra escrita orienta; o gate do CI impede — e só o que impede conta quando tem cliente do outro lado. Quem convive com isso sabe por que eu escrevi sobre perder o medo de subir em produção.
Sobre pair programming eu vou ser duro, e é a visão da empresa: é jogar dinheiro fora com sênior pra ajudar o menino que está começando. Existe o outro lado — estou formando alguém que vai me dar resultado depois de um tempo — e isso depende da pessoa. Mas eu prefiro ser honesto com você a ser simpático.
Amigo desenvolvedor, é aquilo que eu venho falando há muito tempo, e agora com a prova na mão: é hora de estudar arquitetura de sistema, coordenação de sistema e coordenação de inteligência artificial.
Antes que você leia isso como demissão em massa: não é. Os meus júniores e plenos eu estou treinando pra serem orquestradores, pra que consigam desenvolver 5, 10, 15 vezes mais que um desenvolvedor comum. Não é mandar embora — é mudar a função.
O que mudou de verdade é isto: escrever código não é mais segredo pra ninguém. Qualquer um que sentar na frente de um editor com IA hoje faz um sistema. Literalmente qualquer um. Botar em produção a gente sabe que é outra coisa — e é nessa distância que está o seu emprego e o meu negócio.
Então não fiquem preocupados. Vamos estudar. O chinelinho está lascado, mas quem quer levar isso pra frente tem um mercado muito bom pela frente: o mercado de tecnologia só cresce. A diferença é que o bastão subiu. É disso que eu trato na imersão de SaaS e na presencial de infraestrutura — preço, data e condição ficam na página de cada uma, que é onde essa informação vale.
Este relato é do fim de semana de julho de 2026 e da gravação que eu fiz em 16 de julho de 2026 — eu não vou fingir que é de hoje. Três coisas pra você calibrar. Primeira: o modelo que eu usei foi o Fable, naquele momento; modelo muda rápido, e o que vale aqui é o método (escopo fechado, issue detalhada, gate no CI), não a marca. Segunda: eu disse na gravação que não tinha testado o Grok 4.5 — continuo sem afirmar nada sobre ele, porque eu não testei. Terceira: as duas datas e o número da Microsoft que aparecem neste texto eu fui conferir em 22/09/2026, e num dos casos a minha memória estava errada — está corrigido acima, com a fonte.
Eu vendo imersões sobre isso, então desconte a minha propaganda de tudo que você leu. Foi um projeto, não os 300: eu repeti o teste várias vezes, mas dentro de um projeto só — generalizar pra toda a minha operação ainda é uma aposta minha, não um resultado medido. "Substituir" aqui tem escopo: foi uma casa de desenvolvimento júnior/início de pleno dentro do meu pipeline, com QA e sênior humanos do lado — não foi a empresa rodando sozinha. Eu sou empresa de médio porte, com padrão de código, ambiente de sandbox, staging e CI já montados; quem não tem essa base provavelmente não reproduz o resultado tão cedo, e o custo de montar isso não entra na minha conta porque eu já tinha. Pode ser a stack, não o método: eu mesmo digo que a IA se dá melhor com certos tipos de código — o meu resultado pode estar pegando carona nisso. E a parte do pair programming é opinião de dono, não pesquisa: tem empresa que forma gente assim com ótimo resultado.
TODA SEGUNDA · MEIO-DIA · AO VIVO
Discorda? Concorda? Tem um caso parecido? Aqui não tem caixa de comentário de propósito: segunda-feira, ao meio-dia, eu faço live no canal e a gente conversa sobre isso ao vivo — sem corte, como sempre.
Baseado na gravação do canal @josimarjmv publicada em 16/07/2026 (20min05), com transcrição própria das legendas do próprio vídeo. São da minha vivência e foram ditos na gravação: ser dono de empresa de tecnologia com data center no Brasil e nos Estados Unidos, com folha de pagamento e a conta a pagar no quinto dia útil; os setores da operação, da manutenção física de servidores e da telecom até infraestrutura, desenvolvimento full stack, mobile em equipe separada, sites, vendas e suporte; ter me abstido por anos de falar em substituição de programador por IA porque eu precisava fazer acontecer; o curso de IA de uma grande empresa de educação em que o CTO saiu pela tangente nas minhas perguntas, há cerca de um ano, e a conclusão de que eu estava no caminho certo; o pipeline completo — solicitação, reunião, análise de arquitetura e de custo com banda entrando na conta, issue no git com regra de negócio, sprint, QA e produção; a instrução de criar task interna que eu dava ao humano e não posso dar à IA; o escopo fechado, SOLID, MVC e não criar arquivo de 20 mil linhas; o problema da proatividade que consumia mais tempo de correção do que de trabalho; a armadilha de deixar a IA escrever teste sem critério e o esforço humano de desenhar a matriz de teste; o fim de semana em que a IA desenvolveu a feature, validou no sandbox, subiu e me avisou, e o fato de eu ter repetido o teste; a proatividade assertiva do Fable e o loop de revisão das regras; não testar o Grok 4.5; a IA se dar melhor com certos tipos de código e stack; não colocar infraestrutura na mão da IA em produção; o tech lead que arquiteta e puxa os fios dos agentes como o perfil que as empresas vão querer; os 300 projetos, o legado de mais de 10 anos sem documentação completa e a conta de que treinar a IA custa o mesmo tempo que treinar um júnior; treinar os meus próprios júniores e plenos como orquestradores para produzirem 5, 10, 15 vezes mais; Jules, Devin e os agentes integrados ao repositório não atenderem o nível de confiança que eu precisava; QA humano e sênior conferindo diff como o novo gargalo; bloqueio no CI porque regra escrita no arquivo do agente não segura produção complexa; a visão de que pair programming é jogar dinheiro fora com sênior; e a régua que subiu. É apuração minha, feita em 22/09/2026, e não estava na gravação: as datas do lançamento do Fable 5 em 9 de junho de 2026, da diretiva de controle de exportação de 12 de junho e da volta global em 1º de julho, registradas pela própria Anthropic; e a correção do número que eu falei de cabeça — o dado público é de 20% a 30% do código nos repositórios da Microsoft escrito por IA, dito pelo CEO da empresa em abril de 2025, e não os 70% a 80% que eu citei. Duas ressalvas de honestidade: eu não repito aqui preço, data ou condição de turma das minhas imersões, porque essa informação é final e muda a cada turma — ela fica na página de cada imersão; e o nome do cliente, o projeto e a feature envolvidos não são citados nem na gravação nem aqui, por serem de contrato.