Meu stack de LLMs como desenvolvedor no dia a dia na prática
Stack de AIs de um desenvolvedor: cada LLM com um papel — do lookup rápido ao trabalho de código.
Resposta direta
O ponto central em meu stack llms como dev é transformar o insight em critério de decisão esta semana: o que mudar, o que ignorar e como medir. Âncora do material: Este é o meu stack de AIs como desenvolvedor.
Por que este material importa
O ponto central em meu stack llms como dev é transformar o insight em critério de decisão esta semana: o que mudar, o que ignorar e como medir. Âncora do material: Este é o meu stack de AIs como desenvolvedor.
O ponto de partida do material é concreto: Este é o meu stack de AIs como desenvolvedor. Eu vou desligar todos os LLMs que eu uso e descrever em que cenários eu uso cada um.
Contexto real do problema
A restrição que o autor enfrentava aparece cedo: Então, o primeiro é o ChatGPT e agora eu uso o ChatGPT para os momentos em que eu estou apenas olhando algo. Basicamente, quando eu costumava google search algo, agora eu estou adicionando mais e mais chat GPT para o mix.
Em vez de copiar o discurso, isole o gargalo operacional: Eu não uso nenhum produto de AIs abertos em nenhuma das apps que eu construo como desenvolvedor, nem uso em qualquer tarefa de código dia a dia que eu tenho também. O próximo é a família de modelos da Cloud, particularmente a Claude opus 4.
Âncora
Se você não resume a restrição em uma frase, ainda extraiu vibe — não problema.
O que muda na prática
A mudança útil altera fluxo de trabalho, não só a ferramenta: O Claude opus 4 é o meu modelo de código que eu uso no dia a dia. Eu acabei de mudar de cursor para o Claude code full time.
Traduza para o seu time com evidência do próprio cenário: O Claude opus 4 é praticamente o único modelo que eu uso quando eu preciso fazer qualquer de código sério. Eu pago por o plano de cloud de 200 dólares por mês, que é extremamente caro, mas é muito, muito valente para alguém que code muito.
Sinais de que a mudança pegou: Eu costumava usar um pouco de Gemini no meu código do dia a dia, mas hoje em dia o Claude opus 4 é realmente super, super bom. E especificamente o Claude opus 4 e o Claude code são realmente bons.
Checklist curto
1) Dono da decisão. 2) Métrica de 7 dias. 3) Rollback se piorar. 4) Doc de uma página no repo.
Armadilhas e falsas vitórias
O material também aponta (às vezes sem nomear) onde o time se engana: apenas uso modelos de cloud para qualquer coisa relacionada ao código, seja isso implementando código, fazendo planos técnicos, perguntando qualquer pergunta técnica, eu sempre defalo para usar cloud e, por último, é a família de modelos de Gemini de Google para Gemini, eu costumava usá-lo, como eu disse antes, no meu código dia a dia, mas o cloud tem praticamente revertido. Trate cada insight como hipótese: escreva o critério de sucesso antes de virar tarefa no board.
Falsas vitórias comuns: demo bonita sem dados, integração 'pronta' sem observabilidade, e automação que esconde erro em vez de expor.
Para `meu-stack-de-llms-como-dev`, a pergunta de corte é: o usuário consegue completar a tarefa sem você na call? Se não, ainda é protótipo.
Atenção
Não marque como shipped o que só funciona com o founder logado e o .env da demo.
Plano para a próxima semana
Se precisar de âncora do material original, volte a este trecho: Este é o meu stack de AIs como desenvolvedor.
Internalize com links vivos: /blog, /curso-cursor-avancado-configuracoes-pro, /curso-claude-code-9-dicas-profissionais, /programa-crazystack e /checklist-independencia-cursor.
Detalhes operacionais do material
Leitura operacional adicional: Basicamente, quando eu costumava google search algo, agora eu estou adicionando mais e mais chat GPT para o mix. Eu não uso nenhum produto de AIs abertos em nenhuma das apps que eu construo como desenvolvedor, nem uso em qualquer tarefa de código dia a dia que eu tenho também. O próximo é a família de modelos da Cloud, particularmente a Claude opus 4.
Implicações para o time e para o produto: Eu acabei de mudar de cursor para o Claude code full time. O Claude opus 4 é praticamente o único modelo que eu uso quando eu preciso fazer qualquer de código sério. Eu pago por o plano de cloud de 200 dólares por mês, que é extremamente caro, mas é muito, muito valente para alguém que code muito.
O que validar antes de padronizar: E especificamente o Claude opus 4 e o Claude code são realmente bons. apenas uso modelos de cloud para qualquer coisa relacionada ao código, seja isso implementando código, fazendo planos técnicos, perguntando qualquer pergunta técnica, eu sempre defalo para usar cloud e, por último, é a família de modelos de Gemini de Google para Gemini, eu costumava usá-lo, como eu disse antes, no meu código dia a dia, mas o cloud tem praticamente revertido. Trate cada insight como hipótese: escreva o critério de sucesso antes de virar tarefa no board.