Em 6 de maio de 2026, a Anthropic dobrou os limites do Claude Code, eliminou a redução em horários de pico e multiplicou os rate limits da API, atribuindo tudo a um acordo de computação com a SpaceX. Este artigo destrincha os números, o data center Colossus One e o que isso revela sobre a corrida por infraestrutura.
O que mudou nos limites do Claude Code em maio de 2026
A Anthropic anunciou em 6 de maio de 2026 três mudanças imediatas: dobrou o limite da janela de 5 horas do Claude Code para os planos Pro, Max, Team e Enterprise, acabou com a redução de limite em horários de pico e elevou os rate limits da API em todos os tiers. Os números abaixo vêm do anúncio oficial, lido ao vivo por Fernanda Kipper no programa Bora Tomar Café, e são vendor-reported: não há medição independente.
A segunda mudança merece atenção de quem trabalha com o Claude Code no meio da tarde. Antes, quando todo mundo entrava ao mesmo tempo, a capacidade por usuário caía porque os servidores saturavam. Se o seu limite normal era 400.000 tokens, no pico ele podia virar 200.000 (exemplo didático do episódio, não número real). Essa regra deixou de existir para contas Pro e Max, e o seu limite não encolhe mais porque o tráfego subiu.
No chat ao vivo, Fernanda reconheceu uma dúvida honesta: em 2025 a empresa havia reduzido limites, e ela não encontrou na internet uma comparação entre os valores antigos e os novos. Não dá para afirmar se o novo patamar é ganho real ou reposição integral do que existia antes da redução. A documentação de usage limits consultada durante a transmissão ainda mostrava atualização de 16 de março de 2026, ou seja, o anúncio corria à frente das páginas de preços.
Como ficaram os rate limits da API do Claude
Os rate limits da API subiram em todos os tiers de serviço, e os saltos mudam a arquitetura de quem integra o Claude em produtos. Os valores são por minuto e contam tokens de entrada e de saída: tudo que você envia como contexto consome cota, e a resposta do modelo também. Assim estava a tabela do anúncio:
| Tier | Input antes | Input depois | Output antes | Output depois |
|---|---|---|---|---|
| Tier 1 | 30.000 tokens/min | 500.000 tokens/min | 8.000 tokens/min | 80.000 tokens/min |
| Tier 2 | 450.000 tokens/min | 2 milhões tokens/min | 90.000 tokens/min | 200.000 tokens/min |
| Tier intermediário | 800.000 tokens/min | 4 milhões tokens/min | 160.000 tokens/min | 400.000 tokens/min |
| Tier máximo | 2 milhões tokens/min | 10 milhões tokens/min | 400.000 tokens/min | 800.000 tokens/min |
Para quem mantém um SaaS ou um agente conectado via API, o Tier 1 saltando de 30 mil para 500 mil tokens de entrada por minuto elimina filas internas e buffers de retry. Se você usa as ferramentas de desenvolvedor e integrações de IA, revise os limites da sua própria aplicação, porque o gargalo pode ter migrado do provedor para o seu código.
O anúncio não detalhou qual plano corresponde a cada tier. Fernanda arriscou que o tier máximo representa contas enterprise, mas isso ficou como inferência dela, não como fato confirmado.
Por que a SpaceX entrou na história: o acordo do Colossus One
O motivo declarado do aumento é infraestrutura: a Anthropic firmou parceria com a SpaceX para usar a capacidade computacional do data center Colossus One. O acordo dá acesso a mais de 300 MW de nova capacidade e a mais de 220.000 GPUs da Nvidia ainda naquele mês, melhorando diretamente a experiência dos assinantes do Claude Pro e do Claude.
O Colossus One fica em Memphis, no Tennessee, bem na Terra, embora a parceria inclua planos orbitais. Enquanto o supercomputador operar em solo, a Anthropic manifestou interesse em desenvolver com a SpaceX uma capacidade de computação orbital de vários gigawatts no futuro, para escapar das limitações terrestres de energia e refrigeração. Data centers no espaço deixaram de ser especulação e viraram item de contrato.
A leitura estratégica é simples. Supercomputador parado queima dinheiro em manutenção e custo de oportunidade, então alugar a capacidade ociosa interessa aos dois lados. Provavelmente é a Anthropic pagando caro para usar o data center, e não o contrário.
Anthropic monta um guarda-chuva de infraestrutura multi-provedor
O acordo com a SpaceX não veio sozinho. O mesmo anúncio lista outros compromissos de computação:
- Um contrato de até 5 GW com a Amazon, com quase 1 GW novo até o fim de 2026.
- Um acordo de 5 GW com Google e Broadcom previsto para operar em 2027.
- Uma parceria com Microsoft e Nvidia que inclui US$ 30 bilhões em capacidade.
- Um investimento de US$ 50 bilhões em infraestrutura americana com a Fluidstack.
O resultado é tolerância a falhas: o Claude Code em hardware da AWS, nas TPUs do Google e em GPUs da Nvidia ao mesmo tempo. Se um provedor tem problema, a carga migra. Para uma empresa fundada em 2021 como laboratório de pesquisa e dependente 100% de infraestrutura terceirizada, espalhar as apostas é defesa de sobrevivência.
A expansão também é internacional. Clientes corporativos em setores regulamentados, como serviços financeiros, saúde e governo, exigem infraestrutura local para conformidade e residência de dados. Quem trabalhou em banco no Brasil conhece isso: o core que processa pagamentos precisa rodar em data center dentro do país, por determinação do Banco Central, enquanto um app complementar de benefícios pode rodar fora. A parceria com a Amazon inclui inferência adicional na Ásia e na Europa.
Há ainda um compromisso público de cobrir eventuais aumentos na conta de luz de consumidores americanos causados pelos data centers da empresa, com estudo de extensão a novas jurisdições. Fernanda tratou a promessa com ceticismo saudável: sem o tempo passar, não há como separar branding de prática.
Quanto custa o hardware por trás dos tokens
A escala do Colossus One fica mais clara com uma conta de exemplo apresentada ao vivo no programa. Usando a H200 da Nvidia como referência, 220.000 GPUs divididas por 8 GPUs por placa resultam em cerca de 27.200 placas, que a cerca de US$ 315.000 por unidade no cálculo exibido chegariam a bilhões de dólares. Repetindo com o preço mais baixo citado, cerca de US$ 27.000 por GPU, o total cai para algo em torno de US$ 5 bilhões; no teto de US$ 35.000, chega perto de US$ 8 bilhões. O Léo arriscou até US$ 50.000 por placa top de linha. São estimativas didáticas do episódio, não números oficiais, mas dão a medida do hardware. E GPU enterprise degrada rodando em alta intensidade: depois de um tempo, precisa ser trocada.
Esse contexto ajuda a entender o momento da Anthropic. Fundada em 2021, a empresa teria começado com um aporte na casa de 100 milhões de dólares, segundo a leitura feita no ar, e hoje carrega um valuation estimado em US$ 380 bilhões, com mais de US$ 30 bilhões levantados. Fernanda comparou a trajetória à da Apple depois do iPhone de 2007 e 2008: uma quebra de paradigma que, anos depois, virou capítulo de história.
Data centers de IA: o gargalo energético por trás dos tokens
O aumento dos limites só foi possível porque o verdadeiro gargalo dos modelos de IA não é o modelo, é a eletricidade. Um complexo de data centers com 1 GW de demanda máxima, operando a 85% da capacidade ao longo de um ano, consome quase tanta energia quanto 700.000 residências americanas, ou cerca de 1 milhão de pessoas. Fernanda admitiu que achava que a comparação era com uma cidade de 100.000 habitantes; o número real é maior.
E não é só energia. O resfriamento consome água em volume expressivo, e placas como as GPUs Blackwell, que Fernanda viu de perto em visita à Nvidia no Vale do Silício, pesam dezenas de quilos e custam dezenas de milhares de dólares cada.
Essa realidade explica por que assinaturas de IA provavelmente cobram menos do que custam hoje. A aposta repete a do Nubank no cartão de crédito: queimar caixa dos investimentos até a curva de custo de inferência baixar e a operação virar lucro. Se os preços subirem um dia, a expectativa discutida no programa é que grandes empresas paguem para manter times produtivos, enquanto pequenas e médias podem migrar para opções mais baratas.
Vale a pena trocar o Claude Code pelo Codex?
A pergunta do chat foi direta: qual assinatura compensa mais, Claude Code ou o agente de código da OpenAI? A resposta honesta de Fernanda foi que ela nunca assinou o Codex, apenas testou o plano gratuito de forma rasa, e sua opinião é enviesada pelo hábito: o Claude Code já está configurado no fluxo dela, e a preguiça de migrar pesa na decisão.
Na comunidade, segundo o episódio, os dois são tratados como comparáveis em qualidade e entrega. Um participante relatou que migrou do Claude para o Codex e não mudou nada no resultado. Sem benchmark independente citado no programa, a decisão volta para critérios seus: preço, integração com o terminal, formato de assinatura e ecossistema que você já usa.
Se você ainda não testou nenhum, use o trial de cada um por uma semana de trabalho real e compare com o seu próprio código. A bonança de rate limits da API da Anthropic pesa mais para quem constrói produtos; a escolha de assinatura pesa mais para quem programa com IA no dia a dia.
Perguntas frequentes
Quando os novos limites do Claude Code entraram em vigor?
Em 6 de maio de 2026, segundo o anúncio oficial da Anthropic três mudanças começaram a valer na data do comunicado: o dobro de tokens na janela de 5 horas, o fim da redução em horários de pico para Pro e Max e os novos rate limits da API.
O aumento dos limites é temporário?
O anúncio não indica caráter temporário e trata o novo patamar como vigente a partir da data do comunicado. Nada impede um ajuste futuro se a demanda apertar, como aconteceu com a redução de 2025, mas o texto não prevê reversão.
O que é o Colossus One da SpaceX?
É um supercomputador terrestre instalado em um data center em Memphis, no Tennessee, com mais de 220.000 GPUs da Nvidia e mais de 300 MW de capacidade. A parceria dá à Anthropic acesso substancial a essa capacidade para rodar seus modelos.
Os novos rate limits valem para quem usa a API?
Sim. Os saltos de tokens por minuto se aplicam aos tiers de API dos modelos Claude, afetando quem integra o modelo em produtos, agentes e serviços. O Tier 1, por exemplo, passou de 30.000 para 500.000 tokens de entrada por minuto.
A Anthropic construir data centers no espaço?
Ainda não. O anúncio registra interesse em desenvolver, em parceria com a SpaceX, capacidade computacional orbital de vários gigawatts no futuro, para superar as limitações de energia e refrigeração na Terra. É um plano declarado, não uma capacidade existente.
Os novos limites do Claude Code se aplicam a qual plano?
O dobro da janela de 5 horas vale para Pro, Max, Team e Enterprise com base em licenças. O fim da redução em horários de pico vale apenas para contas Pro e Max, conforme o texto do anúncio.
Por que a Anthropic aumentou os limites agora?
Porque fechou o acordo com a SpaceX e soma outros contratos de computação com Amazon, Google, Broadcom, Microsoft e Nvidia. Mais capacidade disponível permitiu liberar mais tokens para assinantes e clientes de API.
A redução de limites de 2025 foi revertida?
Não é possível confirmar. Fernanda procurou durante a live uma comparação entre os limites antigos e os novos e não encontrou. Ela mesma disse ter a impressão de que os limites anteriores à redução não eram tão altos quanto os atuais, mas deixou claro que é impressão, sem dados.
Os assinantes vão pagar mais caro por causa disso?
O movimento atual aponta na direção contrária: mais limite pelo mesmo preço. A leitura do episódio é que ainda há caixa de investimento para queimar enquanto o custo de inferência cai, repetindo a estratégia do Nubank até a curva virar lucro.
Do vídeo ao artigo: transforme sua transmissão em conteúdo
Este artigo nasceu de uma live de 82 minutos do canal Dev Doido do canal do youtube, cheia de contexto que não cabe em uma manchete: números de rate limits, a conta das GPUs feita ao vivo, a análise estratégica da infraestrutura e a opinião de quem usa o Claude Code no dia a dia. Conteúdo assim costuma ficar preso no formato de vídeo, difícil de buscar e de citar depois.
Se você também grava lives, entrevistas ou explicações técnicas no YouTube, o fluxo do Skala Blog resolve isso: você cola o link do vídeo, a transcrição é gerada e o artigo estruturado sai pronto para você revisar e publicar.
Fork this article
Start a new branch from the same video, shaped your way. You keep the credit; the original keeps the attribution.
A fork in another language is filed as a translation of this article, so the two pages point at each other. You can unlink it later from the editor.
0/240
You are creating
- Format
- For
- Language
- Source
- Your angle
You will be asked to sign in before it is generated.
Buy credits