Claude Code caro demais? Cortes de custo com Gemini CLI
Como o preço do Claude Code empurra gente do Cursor — e o que testar com Gemini CLI / OpenRouter para reduzir ticket sem perder entrega.
Ideia central
Bem, se você é um desses pessoas no leaderboard do Claude Code, o setup de 5-branques que está recolhendo, tipo, 2 mil ou mais por dia, você provavelmente vai querer pular tudo sobre ele. Em termos práticos: transforme isso em ritual com métrica e dono, ou o insight morre no feed.
O que o material de origem realmente diz
Bem, se você é um desses pessoas no leaderboard do Claude Code, o setup de 5-branques que está recolhendo, tipo, 2 mil ou mais por dia, você provavelmente vai querer pular tudo sobre ele. Seria custoso três dólares se todos esses erros fossem feitos pela Claude em vez de Só fez fazer um monte de outros modelos GLM4? Eu não gosto de quão grande eles fizeram isso e quão pequeno eles fizeram isso, mas pelo menos é como funcionando, eu não posso me ajudar, faremos uma comparação de GPT-5 muito rápido também, mas a qualidade e o custo que estou vendo aqui são realmente sólidos.
Por que isso importa na operação
Gradiente no botão que eu odeio e este é um dos melhores que eu gerado de Claude com isso gbt5 permanece o rei da UI, mas estou impressionado que o ZAI poderia fazer algo usável aqui oh, nunca parou porque ele fez o comando de dev isso é assustador, vamos pegar status rápido, pegar o stash, dar uma mais tentativa, desta vez eu não vou deixar que ele faça o comando de dev é uma das coisas mais assustadoras que eu tenho que fazer com muitos desses agent tools Eles amam usar comandos de dev, amam usar comandos de build, amam foderar meu ambiente local.
Na prática
Regra: se não há output auditável ligado a «claude code custo gemini cli», ainda é consumo — não sistema.
Como estruturar o método
Mas é muito bom quando você dá componentes decentes o tempo da API era na verdade pior usando os modelos do clube oficial, demorou 1 minuto e 54 segundos onde no Zai demorou como 48 segundos eu acho sim 48 segundos no Zai supostamente 62 centavos, mas não é realmente perto disso porque é apenas fazer o multiplicador na Na parte de trás, o código de Claude oficial, usando os endpoints oficiais, era de apenas 30 centavos.
Erros que drenam o resultado
Eu acabei de limpar esse gráfico para mostrar a inteligência de vários modelos em relação ao custo de gerar o teste de inteligência de análise artificial. Desde que o GEMINI CLI da Google seja totalmente, totalmente aberto, ele foi usado como base para algumas dessas alternativas. Porque se eu deployar modelos antropóficos no Google Cloud, eu vou ter minha própria URL customizada para isso.
Atenção
Não otimize ferramenta antes de ter hipótese e métrica. Stack nova sem critério só acelera o erro.
Aplicação em uma semana
Isso é custo de gerar o teste em relação a quão inteligente o resultado foi. Todas as versões agentes dessas coisas que são muito, muito úteis porque você pode lidar com todos os tipos de workloads estranhos vamos ter isso funcionando rapidamente localmente com agentuidade dev agora temos isso funcionando na nossa máquina podemos ir dar uma olhada na página de modo de dev que é tão útil que se conecta diretamente do browser para sua cli clicamos nisso clicamos em run agora o agente está funcionando na minha máquina conectando-se à openai para fazer as chamadas de api e quando está feito, vamos receber nossa resposta aqui e aí você vai tudo que você precisa para A gente tem que criar uma arquitetura realmente agente que seja disponível em seu SDK e plataforma.
Sim, temos que tentar isso sozinhos, você tem 120 prompções por ciclo de 5 horas para o plano de 3 dólares e até 600 para o plano de 15 dólares, vou com o plano de 15 dólares, tenho que pegar uma chave de API eu uso o script esquisito, eu meio que quero usar o script esquisito eu vou usar o script esquisito, eu não posso me ajudar a fazer o script ok, eu Eu provavelmente deveria olhar para a coisa que acabei de fazer sem verificar.
E se eu puder assistir enquanto está funcionando e gritar quando está errado, eu vou legal, parece ter durado muito mais rápido no geral, aqui você tem um erro de tipo aqui ok parece que não conseguiu o novo sintaxe de chamada de ferramentas certo e por causa disso as coisas são diferentes também o mudamento de passos max não foi aplicado corretamente hum ainda há alguns erros de tipo que indicam mudanças que não foram feitas não esqueça de ler o guia de upgrade que eu linkou antes ele liu eu não acho que ele liu sim eu não acho que ele nunca realmente foi para a página com aquele guia de upgrade cool parâmetros agora esquema de entrada mas essa foi a peça errada para para aqueles que estavam faltando, todos os parâmetros de tinta estão perdidos, vamos fazer com que isso corra Completado, o email do BoldlyAct e os 12 logs já estão no final.
I just don't não acredito nessas metade das terras, por isso eu chamo de problema de vale, há um vale, há uma gama entre a coisa à esquerda e a coisa à direita e se você ver que o gpt 5 é alto custa 3 dólares uma solicitação e 4,5 custa 5 centavos de solicitação, o sentimento de cabeça imediato que você vai ter é oh, precisamos de algo no meio precisamos de algo que seja metade do preço do gpt 5 ou aqui você vê que o astro é realmente bom para sites estáticos e você vê que o react é realmente bom para sites dinâmicos você está tipo oh precisamos de algo no meio precisamos de remix precisamos de rápido Não, você não é.
Isso pode ser que a forma das coisas que o OpenRouter retornou mudou e isso ainda está em AISDKv4, então eu poderia ter dado a ele uma tarefa um pouco impossível por causa da forma como o OpenRouter funciona. Página agora e leva sempre para carregar e não parece que eu fiz espera no setembro 4, os usuários 1 gastaram 94 centavos ok, parece que está atingindo isso então sim, isso é assustador, não use comandos de dev sim, estou cada vez mais inseguro se estou realmente conseguindo o modelo certo com isso que modelo você é eu sou apoiado pela modelagem glm 4.5 ok, então eu construí para isso O que?
Perguntas frequentes
Por que «Por que isso importa na operação» importa agora em Claude Code caro demais? Cortes de custo com Gemini CLI?
Resposta direta do corpo: Gradiente no botão que eu odeio e este é um dos melhores que eu gerado de Claude com isso gbt5 permanece o rei da UI, mas estou impressionado que o ZAI poderia fazer algo usável aqui oh, nunca parou porque ele fez o comando de dev isso é assustador, vamos.
Como isolar «Como estruturar o método» sem montar um plano de 30 dias — recorte `claude-code-custo-gemini-cli`?
Extraia só o mecanismo de «Como estruturar o método»: Mas é muito bom quando você dá componentes decentes o tempo da API era na verdade pior usando os modelos do clube oficial, demorou 1 minuto e 54 segundos onde no Zai demorou como 48 segundos eu acho sim 48 segundos no Zai supostamente 62 centavos, mas não é.
Qual restrição «Erros que drenam o resultado» deixa explícita — recorte `claude-code-custo-gemini-cli`?
Operação curta: Eu acabei de limpar esse gráfico para mostrar a inteligência de vários modelos em relação ao custo de gerar o teste de inteligência de análise artificial. Desde que o GEMINI CLI da Google seja totalmente, totalmente aberto, ele foi usado como base para algumas. Revise com evidência, não com feeling.
O que falha se você pular «Aplicação em uma semana» — recorte `claude-code-custo-gemini-cli`?
Do texto: Isso é custo de gerar o teste em relação a quão inteligente o resultado foi. Todas as versões agentes dessas coisas que são muito, muito úteis porque você pode lidar com todos os tipos de workloads estranhos vamos ter isso funcionando rapidamente localmente.