Uma publicação no Reddit afirma que a OpenAI reduziu pela metade o valor de uma assinatura Codex Pro após a chegada do GPT-6 Sol. A tabela estima cerca de US$ 13 em uso equivalente de API para cada ponto percentual da cota semanal, ante aproximadamente US$ 25 com o GPT-5.6 Sol.

O autor reconhece a redução de preço e relata um uso quase inalterado. O valor equivalente em API pode cair pela metade com uma mesma cota de tokens quando as tarifas são reduzidas pela metade. Para saber se os assinantes recebem menos tokens ou concluem menos tarefas, é preciso outra medição. Os números da publicação não respondem a essa pergunta.

A grande mudança

  • O que mudou: Os registros locais do Codex mostram tokens. Ferramentas de terceiros convertem esses tokens em valores em dólares de API, enquanto o medidor de assinatura da OpenAI usa uma franquia separada.
  • Por que isso importa: Quem paga uma assinatura precisa comparar o trabalho concluído com o valor mensal. Uma estimativa menor em dólares de API pode mudar a percepção de custo-benefício sem mostrar se a assinatura mensal entrega menos trabalho.
  • O que observar: Se os provedores passarão a disponibilizar registros que relacionem modelo, velocidade, composição dos tokens e uso de cache aos débitos da franquia. Esses dados ajudariam equipes a comparar o valor da assinatura entre lançamentos e investigar esgotamentos contestados.

O resultado de 50% aparece antes de qualquer hipótese sobre a cota

As tarifas atuais da API da OpenAI no modo Standard e para contexto curto são de US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída para o GPT-5.6 Sol. No GPT-6 Sol, custam US$ 2 e US$ 10, respectivamente. Estas são as tarifas publicadas da API; a página do modelo do GPT-6 Sol informa que a tarifa para contexto longo se aplica acima de 272 mil tokens de entrada.

Considere uma carga de trabalho fixa, com um milhão de tokens de entrada sem cache e um milhão de tokens de saída, distribuídos em solicitações que permaneçam dentro da faixa de contexto curto:

Modelo

Cálculo de entrada

Cálculo de saída

Total equivalente em API

GPT-5.6 Sol

1M × US$ 4

1M × US$ 20

US$ 24

GPT-6 Sol

1M × US$ 2

1M × US$ 10

US$ 12

Na velocidade Standard, a tabela de créditos do Codex da OpenAI atribui 600 créditos contra 300 para os mesmos totais de entrada e saída sem cache. A página diz que os preços dos créditos, por si só, não determinam o uso incluído na assinatura.

A simples redução de preços pode produzir esse padrão. Para reproduzir o resultado relatado pelo assinante, seriam necessárias informações sobre a composição de tokens e as configurações usadas — dados que a publicação não apresenta em uma comparação pareada de antes e depois.

O que o ccusage mede

A documentação do ccusage para Codex classifica o suporte ao Codex como experimental. A ferramenta lê token_count eventos dos arquivos locais de sessão, agrupa-os pelo modelo no campo turn_context e aplica os preços dos modelos de uma base de dados de tarifas. O resultado é uma estimativa equivalente em API; a documentação diferencia explicitamente esse valor do saldo de créditos do ChatGPT.

A fórmula de custo separa tokens de entrada comuns, tokens de entrada em cache e tokens de saída. Os tokens de raciocínio entram na cobrança de saída. O registro de uma camada de serviço Standard ou Fast também pode alterar a estimativa. Portanto, um valor menor em dólares por ponto percentual combina dois registros diferentes: os tokens precificados localmente e a movimentação da franquia de assinatura da OpenAI.

Para entender melhor como acertos de cache e o tamanho do contexto afetam o custo dos tokens, consulte o guia da BIG CHANGE sobre cache de prompts no GPT-6. Nossa comparação de preços entre GPT-6 e Claude situa a mudança nas tarifas de API no mercado mais amplo de modelos. Nenhum dos artigos apresenta evidências sobre as cotas de assinatura.

O que a OpenAI divulga sobre o uso incluído

A OpenAI estima de 300 a 3.000 mensagens locais com GPT-6 Sol a cada cinco horas no plano Pro 20x, em comparação com 200 a 2.000 no GPT-5.6 Sol. Podem existir limites semanais; a página não informa um teto semanal de tokens. Essas estimativas variam conforme o modelo, o contexto, o raciocínio, as ferramentas, a recuperação de informações e o cache. Elas não permitem determinar a franquia da conta mencionada no Reddit antes e depois da mudança.

O registro de alterações do Codex de 22 de setembro anuncia a chegada do GPT-6 Sol e do Luna com preços menores por token. Não anuncia uma redução no uso incluído nas assinaturas.

As evidências que resolveriam a questão

Três medições respondem a perguntas diferentes:

Pergunta

Registro mínimo necessário

O valor equivalente em API caiu?

Multiplicar as mesmas quantidades de tokens pelo preço publicado de cada modelo. A resposta já é sim.

O GPT-6 Sol consome a franquia de forma diferente?

Usar a mesma conta e o mesmo plano, tarefas comparáveis e parâmetros fixos de raciocínio e velocidade; registrar tokens de entrada, de entrada em cache e de saída, além dos percentuais do painel antes e depois, em várias execuções.

A cota do plano foi reduzida?

Medir o mesmo modelo, as mesmas configurações e a mesma carga de trabalho antes e depois da suposta mudança, em períodos comparáveis entre renovações da cota.

É preciso registrar chamadas de ferramentas, recuperação de informações, crescimento do contexto e estado do cache, pois tudo isso altera o uso. Repetir os testes também é importante: dois agentes podem seguir caminhos diferentes para concluir a mesma tarefa.

A queda relatada no valor equivalente em API é compatível com a redução de preços. Continua sem resposta se a assinatura entrega menos trabalho. Um registro comparável que associe tokens, resultados das tarefas e movimentação do medidor ajudaria a esclarecer a questão; o cálculo, por si só, não confirma uma redução da cota nem descarta um problema de medição.