Os resets do Codex foram puro marketing. O problema era real
A OpenAI repôs a utilização do Codex 5 vezes em dez dias enquanto o Sol consumia os limites depressa demais. Para mim, os reforços esconderam o problema real.

Nesta página
- A OpenAI removeu os banked resets? Não encontrei provas
- Porque repôs a OpenAI os limites do Codex? Crescimento
- Porque é que o Sol gastava tão depressa os limites do Codex?
- Quatro alterações no Codex tornaram o problema mais difícil de ver
- A mesma quota do Codex pode render menos trabalho? Sim
- Os resets do Codex esconderam o problema do Sol? Na prática, sim
- A campanha de resets do Codex visava o Claude? Não no início
- Que provas resolveriam a discussão sobre a utilização do Codex?
O GPT-5.6 Sol consumia os limites do Codex mais depressa do que a OpenAI esperava [1]. Na mesma altura, a OpenAI repôs os limites de todos os clientes pagos cinco vezes em dez dias. Para mim, os resets foram uma manobra de marketing que serviu de cortina de fumo: interromperam as comparações semanais necessárias para medir o problema real.
A OpenAI removeu os banked resets? Não encontrei provas
Não encontrei provas de que a OpenAI tenha removido os banked resets. A alegação começou com relatos no Reddit de que os resets tinham desaparecido [2], mas o centro de ajuda da OpenAI continua a explicar como usar um [3], e os termos do programa de referências continuam a contemplá-los [4]. Vários utilizadores também viram os seus resets regressar em poucas horas.
O relato que deu origem a este artigo veio de um utilizador com dois banked resets, que expiravam a 12 e 13 de agosto de 2026. A opção para os usar tinha desaparecido da interface, e nem atualizar a aplicação nem terminar e voltar a iniciar sessão a trouxe de volta. Uma resposta descreveu uma perda maior, confirmada numa conversa com o apoio: «Tiraram-me três. Tinha dois guardados que expiravam a 11 de agosto e um a 12. Cheguei a contactar o apoio, e o agente confirmou que não tinha nenhum na conta» [5].
Mais abaixo no mesmo tópico, porém, o padrão desfaz-se. Outros utilizadores ainda tinham os seus resets [6], enquanto alguns conseguiam ver um, mas recebiam um erro ao tentar aplicá-lo [7]. Isso é diferente de a OpenAI ter retirado o benefício.
Um utilizador forneceu a comparação mais esclarecedora. Perdeu o reset numa conta, recuperou-o ao terminar e voltar a iniciar sessão e depois verificou uma segunda conta. A primeira conta também tinha recebido um reset global para 100% nesse dia, acompanhado por uma nova data semanal, enquanto a conta que não recebeu o reset global manteve o banked reset [8].
Outros utilizadores disseram que os resets voltaram sem qualquer intervenção [9]. Um tópico separado, publicado quatro minutos antes do principal, descreve o painel a falhar o carregamento dos créditos, em vez de mostrar que não existiam [10].
Tudo isto aconteceu em cerca de três horas. A retirada deliberada de um benefício pago não costuma reverter-se sozinha em algumas contas enquanto um agente de apoio diz a outro cliente, numa frase citada por um utilizador, «não podemos revelar por que motivo adicionamos ou removemos resets» [11].
A outra explicação popular também não encaixa no horário. A página de estado da OpenAI regista nessa manhã um incidente do ChatGPT intitulado «Increased errors for some ChatGPT users», aberto às 07:21 UTC e resolvido às 08:09 UTC [12]. O primeiro relato sobre os resets surgiu às 08:44 UTC [10], cerca de 35 minutos depois de o incidente ter sido dado como resolvido, e os relatos continuaram depois das 11:00. O aviso terminou antes de os relatos começarem e nunca menciona resets nem limites de utilização.
Uma entrada no changelog, uma alteração no centro de ajuda ou os 30 dias de aviso prometidos nos termos do programa de referências mudariam esta conclusão [4]. Até surgir algo assim, a descrição mais rigorosa é uma falha do produto, não a retirada confirmada do benefício.
Porque repôs a OpenAI os limites do Codex? Crescimento
A OpenAI associou diretamente os resets do Codex aos marcos de crescimento dos utilizadores. É por isso que lhes chamo uma manobra de marketing.
A 7 de abril de 2026, Sam Altman escreveu: «Para celebrar os três milhões de utilizadores semanais do Codex, estamos a repor os limites de utilização. Vamos fazê-lo a cada milhão de utilizadores até chegarmos aos dez milhões» [13]. Dois dias depois, Tibo já tratava essa promessa como uma despesa recorrente: «Ao ritmo de crescimento atual do Codex, vamos dever-vos outro reset em menos de duas semanas» [14]. O reset dos quatro milhões chegou a 21 de abril de 2026 [15].
O mecanismo de acumulação apareceu a 11 de junho de 2026, e o changelog da OpenAI descreve-o como angariação de utilizadores sem grandes rodeios: «Adicionada a acumulação de reposições do limite de utilização para utilizadores Plus e Pro, com um reset gratuito no lançamento e convites de referência para ganhar mais durante a promoção em curso» [16]. A oferta decorreu de 11 a 24 de junho e recompensava os dois lados. A página de preços da OpenAI explica que, quando a pessoa convidada envia a primeira mensagem no Codex, ambas as contas recebem um banked reset [17]. A OpenAI estava a comprar utilizadores novos com inferência em vez de descontos, uma opção mais barata para uma empresa que controla a capacidade e que parece mais generosa do que um cupão.
Depois chegou julho de 2026. A OpenAI lançou o GPT-5.6 a 9 de julho, com o Sol como modelo principal [18], e apresentou o ChatGPT Work em simultâneo. O contador avançou depressa o suficiente para desencadear cinco resets em dez dias: seis milhões a 12 de julho [19], sete milhões a 13 [20], oito milhões a 14 [21], nove milhões a 16 [22] e dez milhões a 21 [23].
Há um pormenor importante nessa sequência. A partir dos seis milhões, o número passou a somar os utilizadores do Codex e do ChatGPT Work. O ChatGPT Work tinha apenas três dias quando saiu a publicação dos seis milhões, por isso o valor usado para justificar cada reset mudou discretamente aquilo que contava.
A ordem dos acontecimentos importa: a OpenAI prometeu prémios pelo crescimento, lançou depois um modelo que consumia mais utilização e só admitiu o problema quando já tinha emitido o reset dos dez milhões. O mesmo público do Codex foi o palco da vaga de expectativa seguinte, que verifiquei em o que a OpenAI confirmou mesmo sobre o Astra e o rumor do lançamento do GPT-6.
-
A promessa
Altman: um reset de utilização por cada milhão de utilizadores do Codex, até dez milhões.
-
Resets acumuláveis
Os banked resets chegam como prémio de referência para Plus e Pro.
-
GPT-5.6 Sol
O Sol passa a modelo principal dentro do Codex.
-
Cinco resets em dez dias
Cai o limite de cinco horas e seguem-se os marcos dos seis aos dez milhões.
-
A admissão
O Sol gastava os limites mais depressa do que o esperado; a utilização deverá durar cerca de 18% mais.
-
Os banked resets falham
Relatos de resets desaparecidos, alguns repostos em poucas horas.
Porque é que o Sol gastava tão depressa os limites do Codex?
O Sol consumia os limites mais depressa porque uma tarefa no Codex custa mais quando o modelo faz mais trabalho, mesmo que o preço por token não mude.
O Sol e o GPT-5.5 cobram exatamente os mesmos créditos por token [17], por isso mudar para o Sol parece gratuito na tabela de preços. Mas o Sol pode trabalhar durante mais tempo, chamar mais ferramentas e ler uma parte maior do repositório, e cada um desses turnos é faturado.
Tibo confirmou o efeito a 29 de julho: «Nas últimas semanas, muitos de vocês disseram-nos que o Sol estava a consumir os vossos limites do Codex mais depressa do que o esperado». E acrescentou que «alguns problemas só se tornam claros quando as pessoas usam o modelo à escala real. Devíamos ter reconhecido isto mais cedo e ter sido mais frontais» [1].
A tabela de preços explica por que motivo os utilizadores não conseguiam prever isto apenas pelas tarifas. O Sol e o GPT-5.5 custam ambos 125 créditos por milhão de tokens de entrada, 12,5 para entrada em cache e 750 para saída [17]. A mesma página avisa que a escolha do modelo, o contexto, o raciocínio, as ferramentas, a recuperação de informação e a cache afetam o consumo, por isso o comprimento do prompt não oferece uma estimativa fiável. Também explica que tarefas parecidas podem gastar quantidades diferentes da quota [17]. A média da própria OpenAI para uma mensagem do GPT-5.6 abrange quase uma ordem de grandeza, entre 5 e 40 créditos [17]. Com o modelo seguinte, a própria tabela de preços passou a ser a explicação: como o GPT-6 Astra é cobrado em relação ao Sol.
O comportamento do Sol fica no extremo caro desse intervalo, que é precisamente aquilo que eu já tinha encontrado. Num artigo anterior sobre o excesso de engenharia do Sol descrevi um modelo que continua a trabalhar depois de a tarefa estar resolvida. O Sol também delega em subagentes, uma prática que a documentação da OpenAI identifica como dispendiosa: «Os fluxos de trabalho com subagentes consomem mais tokens do que execuções comparáveis com um único agente» [24]. Um modelo que faz mais trabalho por instrução custa mais por instrução, mesmo quando a tarifa por token não muda.
Quatro alterações no Codex tornaram o problema mais difícil de ver
Quatro alterações surgiram na altura do lançamento do Sol e, em conjunto, dificultaram a identificação do problema: desapareceu o limite de cinco horas, a janela de contexto encolheu, a tabela de preços ficou igual e o número de utilizadores passou a incluir outro produto.
O limite de cinco horas desapareceu
Três dias depois do lançamento do Sol, Tibo anunciou juntamente com o marco dos seis milhões: «A remover temporariamente a restrição do limite de utilização de cinco horas para todos os planos Plus, Business e Pro» [19]. Essa janela impede que uma quota semanal seja gasta numa tarde. Retirá-la durante a semana de lançamento fez o produto parecer sem restrições, mas também permitiu que um modelo com maior consumo por tarefa esvaziasse a quota semanal muito mais depressa. A 14 de julho de 2026, Tibo ainda apresentava a mudança como uma vantagem e dizia aos utilizadores que podiam «explorar os limites do GPT-5.6 Sol e descobrir até onde conseguem ser ambiciosos» [21].
Sottiaux anunciou a 29 de julho de 2026 que o limite regressaria, mas adiou depois a alteração. O limite acabou por regressar ao Plus a 26 de agosto de 2026, enquanto os planos Pro de 100 e 200 dólares continuaram isentos [1] [37]. A 27 de agosto de 2026, a página de preços da OpenAI documentava a janela de cinco horas e deixava o limite semanal em aberto: «Os limites de utilização das mensagens locais e das conversas na nuvem partilham uma janela de cinco horas. Podem aplicar-se limites semanais adicionais» [17]. Trato o regresso desse limite à parte em porque o Codex Plus pode parar o trabalho com quota semanal por usar.
A janela de contexto do Sol no Codex perdeu 100.000 tokens
O anúncio da OpenAI tornou a alteração especialmente fácil de ignorar. A 13 de julho de 2026, Tibo começou uma atualização para os utilizadores do Codex e do ChatGPT Work com a frase «Nada de nerfs, só coisas boas» e explicou depois que a OpenAI tinha reposto o limite de contexto do Sol de 372.000 para 272.000 tokens, porque a janela maior levava a uma cobrança de utilização superior ao previsto [25].
Uma questão aberta no GitHub a 21 de julho de 2026 coloca os valores efetivos lado a lado: 353.400 tokens utilizáveis no lançamento, contra 258.400 depois da alteração ao perfil do servidor [26]. São menos 95.000 tokens utilizáveis, uma redução de cerca de 27%. O changelog da OpenAI registou os 272.000 como correção a 18 de julho de 2026 [16], o regresso prometido ainda não tinha acontecido a 1 de setembro de 2026 e o mesmo modelo continuava a aceitar 1.050.000 tokens através da API [27].
Menos contexto não é apenas um número mais pequeno numa ficha técnica. Uma janela mais curta faz com que uma conversa longa no Codex seja compactada mais cedo. O modelo volta então a ler ficheiros e a reconstruir decisões, e cada um desses turnos é faturado. Na prática, a janela mais curta pode reduzir a utilização por conversa e, ao mesmo tempo, aumentar o número de conversas necessárias para um trabalho grande.
Os preços e os números de utilizadores não mostraram a mudança
A tabela de preços ficou igual, enquanto a contagem de utilizadores começou a incluir dois produtos precisamente quando os resets aceleraram. Nenhuma das alterações é suspeita por si só. Juntamente com a retirada do limite de cinco horas e a janela de contexto mais pequena, porém, deixaram os utilizadores a olhar para um painel, uma tabela de preços e publicações de marcos que não mostravam quanto trabalho cada tarefa estava a consumir.
- mais tempo de utilização típica do Sol
- 18 %
- previsão da OpenAI após as correções de julho de 2026
- tokens de contexto no Codex
- 272.000
- menos do que os 372.000 de 13 de julho de 2026
- tokens de contexto pela API
- 1.050.000
- mesmo modelo, produto diferente
- créditos por mensagem
- 5-40
- intervalo médio da própria OpenAI para o GPT-5.6
O que importa é a diferença entre o modelo da API e o produto incluído na subscrição. O Codex dá ao mesmo modelo cerca de um quarto do contexto disponível na API e cobra o trabalho a uma quota cujo custo médio a OpenAI só consegue apresentar como um intervalo de 5 a 40 créditos por mensagem.
A mesma quota do Codex pode render menos trabalho? Sim
Sim. A OpenAI manteve o tamanho da quota, mas o Sol gastava mais em cada tarefa. A mesma quota podia, portanto, render menos trabalho concluído.
A 30 de julho de 2026, a empresa escreveu que «os preços das subscrições e os orçamentos de quota do ChatGPT e do Codex mantêm-se inalterados» [28], e Tibo tinha sido ainda mais direto na véspera: «não reduzimos a utilização em nenhum plano de subscrição» [1]. As duas frases descrevem o tamanho da quota, não aquilo que ela permite fazer.
A estimativa de 18% da OpenAI resolve essa questão mais estreita. Na mesma publicação de 29 de julho de 2026, Tibo escreveu: «esperamos que a vossa utilização dure cerca de 18% mais no uso típico do Sol» [1]. Se as correções fazem um orçamento inalterado durar mais 18%, o mesmo orçamento rendia menos trabalho antes dessas correções. A OpenAI não reduziu a quota, mas os utilizadores conseguiam fazer menos com ela.
Um exemplo pequeno torna o efeito concreto. Imagine que uma quota semanal cobre 100 tarefas com o GPT-5.5 e que a mesma tarefa gasta mais 50% de créditos com o Sol. A quota passa a cobrir cerca de 67 tarefas, e uma melhoria de 18% leva esse número para cerca de 79. Os valores são inventados, mas a proporção mostra por que motivo «não reduzimos a sua quota» e «consigo fazer menos por semana» podem ser verdade ao mesmo tempo.
A OpenAI publicou outras duas percentagens, mas elas respondem a outra pergunta. A empresa disse que o trabalho do Sol nos kernels reduziu em 20% o custo total de servir o modelo e que as experiências aumentaram em mais de 15% a eficiência da geração de tokens [28]. Esses valores medem os custos da OpenAI, não a quota do utilizador.
O mesmo anúncio transferiu algumas poupanças para os clientes ao reduzir em 80% o preço do Luna na API, em 20% o do Terra e ao fazer ambos gastarem menos créditos no Codex. O preço do Sol continuou igual [28]. Apenas a estimativa de 18% descreve quanto mais deverá durar a quota de quem usa o Sol.
Os resets do Codex esconderam o problema do Sol? Na prática, sim
Na prática, sim. Um reset volta a encher a quota, mas apaga o registo semanal necessário para comparar o Sol com o GPT-5.5. Uma comparação útil exige um início conhecido, uma versão do modelo, um nível de esforço estável e nenhum reforço a meio. Entre 12 e 21 de julho de 2026, cinco resets tornaram esse registo quase impossível.
É por isso que os relatos do Reddit dessas semanas são tão difíceis de comparar. Os tópicos juntam «gastei 40% em três horas» com «usei 2% durante todo o dia», mas os casos não têm a mesma versão do modelo, nível de esforço, repositório ou estado da cache. Em muitos, também caiu um reset a meio. Os relatos foram coerentes o suficiente para a OpenAI agir [1], mas nunca tiveram a precisão necessária para quantificar a mudança. Os resets explicam boa parte dessa falta de precisão.
Os resets também criaram um motivo para gastar depressa. Quando a OpenAI anuncia um reset global para mais tarde no mesmo dia, usar tudo o que resta passa a ser a escolha racional, e a campanha transformou isso num acontecimento regular. Esse aumento súbito de atividade ajuda uma campanha de crescimento, mas produz dados fracos para quem tenta observar o consumo normal.
Os dois tipos de reset também não têm o mesmo valor, o que explica a preocupação de 10 de agosto de 2026. A OpenAI aplica um reset global a todas as contas elegíveis no momento que escolhe, por isso o valor depende de quanto o utilizador já gastou. Um banked reset é resgatado pelo utilizador. Vale mais porque você controla o momento, mas também pode ser desperdiçado. Um utilizador descreveu exatamente isso: estava nos 10%, tinha o reset semanal marcado para 11 de agosto de 2026, resgatou o último banked reset, recebeu um reset global no mesmo dia e viu o reset semanal seguinte passar para 15 de agosto de 2026 [29].
| Propriedade | Reset global | Banked reset |
|---|---|---|
| Quem o desencadeia | OpenAI | Você |
| Momento | Anunciado com minutos ou horas de antecedência | Quando você quiser |
| Expira se não for usado | Não se aplica | 30 dias depois de ser atribuído |
| Adia a data do reset semanal cerca de sete dias | Não documentado | Sim |
| Pode ficar sem valor por causa do outro tipo | Não | Sim |
Um banked reset é mais útil porque o utilizador controla quando o aplica. Um reset global pode retirar essa vantagem poucas horas depois, quando o banked reset já adiou a data da reposição semanal.
A campanha de resets do Codex visava o Claude? Não no início
Não no início. O calendário dos resets seguia os marcos de utilizadores da OpenAI e começou dois meses antes do Claude Fable 5, por isso a campanha não nasceu como resposta à Anthropic. A competição tornou-se explícita mais tarde, no material de lançamento do Sol e num reset anunciado durante uma discussão pública com a equipa do Claude.
A coincidência mais tentadora não resiste às datas. A Anthropic lançou o Fable 5 a 9 de junho de 2026 [30], e a OpenAI apresentou a acumulação de resets a 11 de junho, dois dias depois [16]. Ninguém concebe e constrói um programa de referências em 48 horas. A Anthropic suspendeu o acesso ao Fable 5 no dia seguinte, ao abrigo de uma diretiva norte-americana de controlo de exportações, e reabriu-o globalmente a 1 de julho de 2026. Até 7 de julho, o modelo podia contar para metade dos limites semanais nos planos Pro, Max, Team e em alguns planos Enterprise [31]. A campanha de resets decorreu antes, durante e depois destes acontecimentos.
A OpenAI tornou a competição inequívoca na página de lançamento do Sol. O Claude Fable 5 surge pelo nome em várias tabelas, e o texto destaca um resultado: «O GPT-5.6 Sol com raciocínio max estabelece um novo estado da arte com 80, 2,8 pontos acima do Fable 5, enquanto usa menos de metade dos tokens de saída, demora menos de metade do tempo e custa cerca de um terço» [18]. A mesma página inclui um resultado que não comenta no texto: no SWE-Bench Pro, o Fable 5 marca 80,0%, contra 64,6% do Sol [18]. É normal que um lançamento escolha o benchmark que quer destacar. O leitor continua a precisar de saber qual resultado produziu o título.
O reset de 8 de agosto de 2026 é o caso mais claro de um reset usado como gesto competitivo. Um utilizador afirmou que a Anthropic lhe tinha suspendido a conta por executar o Sol através do Claude Code. Boris Cherny, da Anthropic, respondeu que a empresa não proíbe ninguém de usar o seu harness com outros modelos e aproveitou para lançar uma provocação de recrutamento a Tibo [32].
Tibo respondeu citando essa publicação e repondo os limites de todos: «É isso mesmo, o GPT-5.6 Sol é excelente e pode ser usado em praticamente qualquer lado, incluindo no harness do CC. Para celebrar isso, juntamente com o facto de eu não ir a lado nenhum… repus os limites de utilização de todos os utilizadores pagos do ChatGPT Work e do Codex» [33]. Minutos depois, um utilizador disse-lhe que o gesto era vazio, porque o reset semanal já tinha ocorrido na véspera: «A esta altura isto é só para inglês ver» [34]. Tibo adotou a expressão: «Na segunda-feira faço outro reset para inglês ver» [35]. Quando quem conduz a campanha adota a palavra usada pelo crítico, a questão do marketing fica resolvida.
A Anthropic nunca respondeu publicamente à comparação. A 18 de julho de 2026, aumentou em 50% os limites semanais do Claude Code até 19 de agosto, sem mencionar a OpenAI [36]. O que aconteceu depois a esses limites semanais tem um artigo próprio: a quota semanal mais baixa do Claude Code depois de terminar uma promoção.
Que provas resolveriam a discussão sobre a utilização do Codex?
Uma comparação semanal limpa resolveria a discussão: um plano, uma versão do modelo, um nível de esforço, um repositório e as mesmas tarefas ao longo de dois períodos completos, sem qualquer reset. Ninguém publicou esse teste. Até alguém o fazer, os números da OpenAI e os relatos dos utilizadores podem estar ambos corretos, porque medem coisas diferentes.
A minha leitura mantém-se: a manobra acabou por servir de cortina de fumo, qualquer que tenha sido a intenção da OpenAI. O Codex passou de três para dez milhões de utilizadores em 15 semanas, as queixas mais ruidosas sobre o consumo receberam reforços gratuitos em vez de números comparáveis e nunca existiu a semana limpa de dados que poderia ter resolvido a discussão.
A medida prática é simples. Faça uma captura de ecrã do painel de utilização, incluindo o número de resets e a data de expiração, porque esse painel alojado pela OpenAI é o único registo a que você tem acesso. Não use um banked reset num dia em que a empresa já tenha anunciado um reset global. O centro de ajuda explica que usar um banked reset completo move a data da reposição semanal para cerca de sete dias depois [3]. Gastá-lo pouco antes de um reforço gratuito elimina o controlo sobre o momento que lhe dava valor.
Fontes
- On Sol using Codex limits faster than expected
- Open AI removes banked usage resets from Codex
- Using Codex with your ChatGPT plan
- ChatGPT Desktop Referral Promotions
- Comment reporting three removed banked resets and a support check
- Comment reporting an intact banked reset
- Confirmed reset bug
- Comment comparing a globally reset account with a second account
- Comment reporting both banked resets returning unprompted
- Banked usage limit reset credits not showing on ChatGPT web or desktop
- Comment quoting an OpenAI support reply
- Increased errors for some ChatGPT users
- On resetting usage limits at three million weekly Codex users
- On owing users another reset at the current growth pace
- On four million Codex users and another rate limit reset
- ChatGPT & Codex changelog
- Pricing
- GPT-5.6: Frontier intelligence that scales with your ambition
- On six million users and temporarily removing the five hour limit
- On seven million users and a banked reset for everyone
- On eight million users and another reset
- On nine million users and another reset
- On ten million users and another reset
- Subagents
- On reverting the Sol context size limit to 272k
- Restore GPT-5.6 Sol's 372k Codex context window, or provide an opt-in setting
- GPT-5.6 Sol
- Advancing the price-performance frontier with GPT-5.6
- OpenAI Screwed me on my resets
- Claude Fable 5 and Claude Mythos 5
- Redeploying Claude Fable 5
- On bans, harnesses and hiring
- On Sol in the Claude Code harness and a reset for all paid users
- On the reset being performative
- On doing another performative reset on Monday
- On keeping Claude Code weekly limits 50% higher
- On restoring the five-hour limit for Plus accounts





