OpenRouter: LLMs misteriosas com 2 milhões de contexto
O que muda com modelos anônimos de 2 milhões de tokens no OpenRouter, hipóteses Gemini e por que modo solo ainda importa.
Ideia central
OpenRouter: LLMs misteriosas com 2M de contexto: a lição do material de origem só paga se você transformar o insight em sistema — dono, métrica e ritual — em vez de acumular abas e intenção.
O que o material de origem realmente diz
O que eu tapei aqui você criar a pe e aqui no cursor eu consigo pegar essa pe se eu vim aqui em modelos cadê modelos e vim aqui ó a pique aqui também não vai ter provavelmente chover não não tem não e se eu clicar aqui em apx ao consigo pegar uma a pe aqui vendo no drop override deixa eu ver azuri tal aws e deve ter uma forma de gente colocar da a da OpenRouter que eu acho que é a mesma coisa que a da OpenAI, acho que funciona do mesmo jeito, ?
Por que isso importa na operação
Ontem, de forma misteriosa, a OpenRouter lançou duas novas LLMs ali na ferramenta deles, ? E também tem de 2 milhões de janelas de contexto, ele também suporta imagem e também suporta auto-calming ali a diferença dos dois provavelmente é, um é mais rápido do que o outro, é mais focado em tanking, é igual mais ou menos ao GPT-5, que tem o modo normal e o tanking, o normal é uma porcaria e o tanking é bom, é ótimo, inclusive o GPT-5, só que o modo sem tanking é uma porcaria é, então Ontem lançou a chama aleatória, esses dois, foi 9h48 da noite que lançou, estou gravando esse vídeo aqui 4h da tarde do dia seguinte Então não faz nem 24h, acho que não tem ninguém fazendo esse vídeo aqui ainda, não no Brasil Então aqui ó, eu vou deixar esse link aqui galera pra vocês verem na descrição, aí esse link aqui vai ter as formas de você utilizar que aqui embaixo Vai ter tanto o post que eu tô lendo aqui com vocês, quanto os links pra você testar, senão vai ficar muito link na descrição e daí complica Então aqui ó, use the Enduring the Alpha Pair to Free Free.
Na prática
Regra: se não há output auditável ligado a «openrouter llms 2m contexto», ainda é consumo — não sistema.
Como estruturar o método
Como escondido, como Secret Stealth, que eles chamam aqui, não tem nome de quem fez esse modelo, e provavelmente vão pegar um feedback ali de graça, muita gente vai começar a utilizar e tal, até porque eles lançaram aqui essa mensagem, teve muito alcance, porque 2 milhões de janelas de contexto é muita coisa, dificilmente você vê o modelo sendo lançado assim, se não me engano acho que é o único até agora que tem essa janela de contexto, se você sabe de uma que tem que é maior, comenta aqui embaixo, eu sei que tem tipo Maverick, que tem bastante contexto também e tal, mas é pouca gente que usa, , mas é isso.
Atenção
Não otimize ferramenta antes de ter hipótese e métrica. Stack nova sem critério só acelera o erro.
Erros que drenam o resultado
O alfa então vou criar essa API aqui vou copiar a pique aqui e vou vir no cursor e vou colar aqui na parte de opinião vendo bom então só nem aqui ó Sky Alpha vendo então se eu clicar aqui no Sky Alpha agora eu consigo conversar com com essa com essa coisa modelo ver se vai funcionar o motorize o ip aqui não deu certo vamos ver aqui de novo então consegui colocar aqui a questão de colocar aqui galera é que você tem que pegar a pique que aqui que eu gerei agora pouco é de você tem que copiar esse link que aqui ó que vou deixar na descrição para você pegar também que é a base e o ar é o que você precisa trocar não é da opinião que você tem que utilizar por isso que não deu certo aqui aí o nome do modelo que você tem que dar é exatamente como aqui ó então só copia aqui o modelo e coloca para adicionar modelo aqui e coloca bem esse nome que aqui então já tô utilizando aqui já é de graça aqui 200 mil de contexto só porque o curso limita obviamente ele não ia deixar os 22 milhões de limite mas tudo bem Então, a gente já tem acesso a esse modelo de graça por aqui.
Hoje, atualmente, o Gemini 2.5, ele tem 1 milhão de janelas de contexto, e é a maior que tem atualmente, ? É isso mesmo, a OpenRouter provides a OpenAI com Comparable Completion API. Tem muita gente chutando, que é o Gemini 3 que parou no 2.5, , agora e o Gemini 3 está pra ser lançado, talvez seja um desses dois aqui seja, por exemplo, um modelo melhor e outro mais rápido, tal, alguma coisa assim e o que a gente sabe aqui, então, eu vou ler aqui pra vocês verem depois a gente vai testar aqui as duas E eu vou deixar o link aqui na descrição também pra você testar se você quiser, ?
Então, bom, porque ele mesmo documenta, ele mesmo segue esse documento que ele criou e tal, e ele não precisa depender de janela de contexto para se lembrar do que ele tem que fazer. Então, por exemplo, se eu mando uma mensagem grande, a resposta também é grande, o que a Yata teve que fazer também é muita coisa, essa janela de contexto vai muito rapidinho, entendeu?
Então, atualmente, lá no Cursor, por exemplo, a gente tem o Cloud 4, , que eu utilizo bastante, ele tem, se não me engano, 250 mil só de janela de contexto. Então, ali em média, que eu tenho visto, uma mensagem comum, assim, de uma atuação comum, geralmente ali gasta 50 mil de janela de contexto, mais ou menos isso, ?
Perguntas frequentes
Em OpenRouter: LLMs misteriosas com 2 milhões de contexto, o que «Por que isso importa na operação» pede para fazer esta semana?
Extraia só o mecanismo de «Por que isso importa na operação»: Ontem, de forma misteriosa, a OpenRouter lançou duas novas LLMs ali na ferramenta deles, ? E também tem de 2 milhões de janelas de contexto, ele também suporta imagem e também suporta auto-calming ali a diferença dos dois provavelmente é, um é mais rápido do.
Como provar «Como estruturar o método» com um experimento mínimo — recorte `openrouter-llms-2m-contexto`?
Operação curta: Como escondido, como Secret Stealth, que eles chamam aqui, não tem nome de quem fez esse modelo, e provavelmente vão pegar um feedback ali de graça, muita gente vai começar a utilizar e tal, até porque eles lançaram aqui essa mensagem, teve muito alcance. Revise com evidência, não com feeling.
Quando «Erros que drenam o resultado» deve esperar atrás de oferta/canal — recorte `openrouter-llms-2m-contexto`?
Do texto: O alfa então vou criar essa API aqui vou copiar a pique aqui e vou vir no cursor e vou colar aqui na parte de opinião vendo bom então só nem aqui ó Sky Alpha vendo então se eu clicar aqui no Sky Alpha agora eu consigo conversar com com essa com essa coisa.
Qual sinal mostra que «O que o material de origem realmente diz» saiu do papel?
O que eu tapei aqui você criar a pe e aqui no cursor eu consigo pegar essa pe se eu vim aqui em modelos cadê modelos e vim aqui ó a pique aqui também não vai ter provavelmente chover não não tem não e se eu clicar aqui em apx ao consigo pegar uma a pe aqui. Em «O que o material de origem realmente diz», trate como experimento com dono e prazo — não como lista de intenções.