Montar SquadSolicitar Orçamento
Notícias22 de setembro de 20268 min de leitura

Preço de IA caiu: Opus 5.5 e GPT-6 Sol, e quanto muda na sua fatura

A Anthropic fala em 40% e a OpenAI em 50%. A tabela diz outra coisa, e a diferença entre o corte anunciado e o corte na fatura está na fatia da conta que é leitura de cache.

Índice do artigo
faltam 7 min de leitura

A Anthropic diz que o Claude Opus 5.5 custa 40% menos que o Opus 5. A tabela de preços diz 20%. Os dois números estão certos ao mesmo tempo, e a distância entre eles é exatamente o que decide se a sua fatura vai cair muito, pouco ou quase nada.

No mesmo dia, 22 de setembro, a OpenAI lançou o GPT-6 Sol e o GPT-6 Luna "pela metade do preço". Metade de quê é a pergunta: a comparação é com um preço promocional do GPT-5.6 que continua valendo, pelo menos, até 21 de novembro.

Dois anúncios, dois percentuais redondos, e nenhum dos dois é o número que vai aparecer no seu cartão. O que aparece depende de uma coisa que quase ninguém mede: quanto da conta é entrada nova, quanto é saída e quanto é leitura de cache.

O que mudou nas duas tabelas

ModeloEntradaSaídaLeitura de cacheReferência anterior (entrada e saída)
Claude Opus 5.5US$ 4US$ 20US$ 0,20Opus 5: US$ 5 e US$ 25, com cache a US$ 0,50
GPT-6 SolUS$ 2US$ 10US$ 0,20GPT-5.6 Sol promocional: US$ 4 e US$ 20
GPT-6 LunaUS$ 0,10US$ 0,50US$ 0,01GPT-5.6 Luna promocional: US$ 0,20 e US$ 1,20

Fonte: documentação de preços da Anthropic e da OpenAI, leitura de 22/09/2026. Preço de tabela da API direta, endpoint global, por milhão de tokens. A leitura de cache do Opus 5.5 custa 0,05x da entrada; nos demais modelos Claude, 0,1x; na OpenAI, 0,1x.

O Opus 5 continua na tabela, ao preço antigo, e nenhum dos dois documentos da Anthropic fala em aposentá-lo. O Fable 5.1 também não mudou: US$ 10 de entrada e US$ 50 de saída. O que a Anthropic acrescentou ao Opus 5.5 foi um fast mode a US$ 8 e US$ 40, e a promessa de Sonnet 5.5 e Haiku 5.5 "nas próximas semanas", que é intenção declarada, não data.

Do lado da OpenAI, o GPT-6 Astra, lançado no começo do mês, segue a US$ 10 de entrada e US$ 50 de saída. Sol é o modelo do meio, para código e tarefa longa; Luna é o de volume, para resumo e extração. Os ids de API são gpt-6-sol e gpt-6-luna, com seis níveis de esforço de raciocínio e medium como padrão.

Por que "40% mais barato" não é o corte da tabela

A Anthropic publicou três números sobre custo no anúncio do Opus 5.5, e eles medem coisas diferentes. Entrada e saída caíram 20%. A leitura de cache caiu 60%, de US$ 0,50 para US$ 0,20. E o "40% menos em cargas típicas" é uma reivindicação da empresa que soma o preço a um terceiro fator: segundo a Anthropic, o modelo novo usou cerca de 40% menos chamadas e metade dos tokens do Opus 5 para resolver as tarefas do Terminal-Bench.

Dá para fazer a conta ao contrário. Se o corte viesse só do preço, para uma fatura cair 40% a leitura de cache teria que ser metade da conta antiga: entrada e saída caem para 0,8 do valor, cache cai para 0,4, e a única composição em que a média dá 0,6 é a de partes iguais. Uma conta em que metade do gasto é leitura de cache é uma conta de agente com contexto longo e repetido, não a de um chatbot de atendimento.

Como referência de planejamento, e não medição: uma operação que consome 100 milhões de tokens de entrada nova, 20 milhões de saída e 300 milhões lidos do cache por mês pagava US$ 1.150 no Opus 5 e passa a pagar US$ 860 no Opus 5.5, um corte de 25%. Um sistema sem cache nenhum cai exatos 20%. O resto do caminho até os 40% da Anthropic depende de o modelo novo gastar menos tokens na sua tarefa, e isso não está na tabela de preço: está no seu teste.

Há um detalhe que joga contra em tarefa curta. No Opus 5.5 o raciocínio não pode ser desligado, só regulado. Tokens de raciocínio são cobrados como saída, a US$ 20 por milhão, e uma aplicação que hoje roda o Opus 5 com raciocínio no mínimo pode ver a saída crescer antes de ver o preço cair.

O "50%" da OpenAI é contra um preço promocional que continua valendo

O GPT-5.6 Sol nasceu, em julho, a US$ 5 de entrada e US$ 30 de saída. Registramos essa tabela na data. Depois a OpenAI passou a praticar um preço promocional de US$ 4 e US$ 20, e é sobre esse promocional que o "50% mais barato" do GPT-6 Sol foi calculado. Contra o preço de lançamento de julho, o corte é de 60% na entrada e de 67% na saída.

A doc de preços da OpenAI traz outra frase que vale ler com calma: o preço promocional do GPT-5.6 Sol "está disponível pelo menos até 21 de novembro de 2026". A data é do modelo antigo, não do novo. Quem hoje roda o GPT-5.6 Sol continua pagando US$ 4 e US$ 20 e não recebe corte nenhum sem trocar de modelo, e trocar de modelo não é trocar de preço: é outro comportamento, com outra rodada de teste dos prompts.

No Luna, a conta da própria OpenAI não fecha redonda. A tabela rotula a linha como "50% mais barato", e a entrada de fato caiu de US$ 0,20 para US$ 0,10. A saída caiu de US$ 1,20 para US$ 0,50, que é 58%. É corte maior do que o anunciado, e a inconsistência é da fonte.

Os placares de hoje comparam com o modelo de ontem

Os dois anúncios trazem tabelas de benchmark, e as duas foram medidas por quem vende o modelo. A OpenAI publica o GPT-6 Sol em esforço xhigh com 33,2% no AutomationBench a US$ 0,27 por tarefa, e coloca o Claude Opus 5 em esforço máximo com 26,9% a 11,1 vezes esse custo. A comparação é com o Opus 5. O Opus 5.5, lançado no mesmo dia e 20% mais barato na tabela, não aparece.

A mesma OpenAI registra, no rodapé, que os placares dos concorrentes vieram de relatórios públicos e que o custo do Claude Fable 5.1 na medição "subestima o custo real", porque em cerca de 40% das tarefas o Fable delegou para o Opus 5 e esse gasto ficou de fora. É um rodapé honesto que desmonta a própria manchete: custo por tarefa medido pelo concorrente, com o modelo de ontem e com parte do gasto omitida, não é o custo por tarefa do seu sistema.

A Anthropic faz o mesmo movimento em sentido contrário. Publica o Opus 5.5 com 66,4% no Terminal-Bench 4.0 contra 55,8% do Fable 5.1 e 52,3% do Opus 5, e 54,4% no FrontierCode contra 50,3% e 48,0%. Placar autodeclarado, sem reprodução independente no dia do lançamento. Para acompanhar esses números conforme aparecem medições de terceiros, mantemos o comparativo de modelos de IA, com proveniência por campo e atualização semanal.

Em reais, e onde o dado fica

US$ 4 por milhão de tokens de entrada PTAX de venda R$ 5,1161 R$ 20,46 por milhão
Opus 5.5, entrada, só câmbio de 22/09/2026. Sem IOF e sem tarifa do cartão, que dependem da forma de pagamento.

Na mesma conta, a saída do Opus 5.5 sai a R$ 102,32 por milhão de tokens. O GPT-6 Sol fica em R$ 10,23 de entrada e R$ 51,16 de saída. Por token de tabela, o Sol custa metade do Opus 5.5, e essa é a única comparação direta que os dois documentos permitem: token de um fornecedor não é a mesma unidade que token do outro. A própria doc da Anthropic avisa que os modelos Claude 4.7 e posteriores produzem cerca de 30% mais tokens pelo mesmo texto que a geração anterior. Comparar fornecedores é comparar custo por tarefa, no seu texto, e não preço por milhão.

Onde o dado é processado também entra na conta. O post da AWS lista o Opus 5.5 nos perfis de inferência dos Estados Unidos, Europa, Austrália, Japão e Global, e nas regiões da Virgínia e de Melbourne. São Paulo não está na lista de lançamento. Para quem precisa de processamento no Brasil não há opção na lista de hoje, e para quem aceita processar fora, o endpoint regional custa 10% a mais que o global no Bedrock e no Google Cloud, e que a operação entra na sua avaliação de transferência internacional de dados sob a LGPD.

Para quem isso não muda nada

Os anúncios de hoje são sobre preço de API. Quem paga assinatura por assento, no ChatGPT Business ou no Claude Team, não encontra nos dois documentos nenhuma mudança no valor da vaga.

Quem está no GPT-5.6 Sol continua pagando o promocional até pelo menos 21 de novembro, e só vê o corte se migrar para o GPT-6 Sol. Quem calibrou prompts no Opus 5 tem o modelo intacto na tabela e uma troca que exige teste de regressão, com o raciocínio sempre ligado do lado de lá. E quem gasta pouco em tokens por mês tem pouco a ganhar em valor absoluto, e a troca custa o mesmo trabalho de teste de quem gasta muito.

O anúncio mexe em um componente do custo total, o consumo. Os outros seguem sem dado público nos dois documentos: a engenharia da troca, o teste de regressão, a instrumentação do campo usage para separar a fatura por tipo de token, a conformidade quando o processamento sai do país, e quem sustenta a decisão quando a próxima tabela mudar. É nesses componentes, e não nos 20% ou 50%, que a conta de verdade se decide.

A fatura que você tem na mão

Nos projetos que operamos, a fatura de IA chega como um número por fornecedor. A separação entre entrada nova, leitura de cache e saída aparece pela primeira vez quando alguém pergunta por que a conta subiu. Esta semana ela serve para a pergunta inversa.

A decisão que cabe fazer agora, com o que você já tem: pegue a fatura do último mês, separe as três linhas, e aplique as duas tabelas acima antes de qualquer conversa sobre trocar de modelo. Se a leitura de cache for uma fatia pequena, o seu corte no Opus 5.5 é de 20%, e não de 40%. Se você está no GPT-5.6 Sol, o seu corte é zero até migrar.

Qual fatia da sua última fatura de IA foi leitura de cache?

Fontes

  • Anthropic, anúncio do Claude Opus 5.5 e documentação de preços, 22/09/2026. Preços de tabela: fonte primária. "40% menos em cargas típicas", "30% mais rápido", placares de benchmark: reivindicação da empresa, sem método publicado ou reprodução independente na data.
  • OpenAI, anúncio do GPT-6 Sol e Luna, documentação de preços e página do modelo, 22/09/2026. Preços de tabela e vigência do promocional do GPT-5.6 Sol: fonte primária. AutomationBench e "metade dos erros": avaliação da própria OpenAI.
  • AWS, post de disponibilidade do Opus 5.5 no Amazon Bedrock, 22/09/2026, para a lista de regiões de lançamento.
  • Preço de lançamento do GPT-5.6 Sol: tabela oficial da OpenAI transcrita no nosso guia de 20/07/2026.
  • Banco Central, PTAX de venda de 22/09/2026.
  • Percentuais de corte, fatia de cache necessária e conta em reais: cálculo nosso sobre os valores acima. O exemplo de 100 milhões, 20 milhões e 300 milhões de tokens é premissa de planejamento, não dado de mercado.
Post anterior
Meu ERP não tem API: as saídas que existem e o que custam
Próximo post
Revisar 100% do que a IA produz: o custo e a saída por amostragem
Newsletter

Um e-mail por mês, sem ruído

O que aprendemos entregando software sob medida e IA aplicada.

Artigos similares

Credencial exposta e agente de IA: a porta já estava aberta9 min · Notícias
O que é Front-end e Back-end?3 min · Notícias
O que aprendemos no Insurance Day?1 min · Notícias
O que aprendemos no Varejotech Conference?2 min · Notícias
O que aprendemos no Agrotech Conference?2 min · Notícias

Acelere a sua empresa com a X-Apps

Alocar profissionaisSolicitar Orçamento
A X-Apps é um provedor de TI parceiro e aconselhada pelo
Gartner
Receba nossos e-mails
Siga nossas redes sociais
O seu time de tecnologia e IA. Software sob medida, soluções de IA e alocação de profissionais.
Vamos conversar?
comercial@x-apps.com.br11 5083-0122

Rua Rodrigo Vieira, 126

Jardim Vila Mariana. São Paulo, SP.

CEP: 04115-060

Mapa do site
Termos de serviçoTermos de privacidade
Available in English