Duas mudanças de preço em três semanas: o que aconteceu

O mês de julho e o início de agosto de 2026 entregaram dois movimentos de precificação que afetam diretamente quem paga fatura de API de IA.

Movimento 1, 30 de julho: A OpenAI reduziu o preço do GPT-5.6 Luna em 80% e do GPT-5.6 Terra em 20%. O modelo de topo da família, Sol, não mudou.

Movimento 2, 10 de agosto: A Anthropic cancelou o reajuste planejado para 1.º de setembro no Claude Sonnet 5. O preço promocional de lançamento virou o preço permanente.

Os dois fatos vêm de fontes primárias: o anúncio da OpenAI está em openai.com/news e a atualização da Anthropic está na documentação oficial da plataforma Claude.


Os números exatos (sem arredondamento)

Família GPT-5.6 (OpenAI), por 1 milhão de tokens

Modelo Entrada Saída Variação em 30 jul
Sol US$ 5,00 US$ 30,00 sem mudança
Terra US$ 2,00 US$ 12,00 corte de 20%
Luna US$ 0,20 US$ 1,20 corte de 80%

Fonte: OpenAI, openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/, 30 jul 2026.

Claude Sonnet 5 (Anthropic), por 1 milhão de tokens

Situação Entrada Saída
Preço lançamento (jun 2026) US$ 2,00 US$ 10,00
Preço previsto a partir de 1.º set 2026 US$ 3,00 US$ 15,00
Preço atual (permanente) US$ 2,00 US$ 10,00

Fonte: Anthropic, anthropic.com/news/claude-sonnet-5, atualização de 10 ago 2026, e documentação oficial platform.claude.com/docs/en/about-claude/pricing.

"O preço de US$ 2/US$ 10 por milhão de tokens de entrada/saída do Claude Sonnet 5, anunciado como preço introdutório até 31 de agosto de 2026, é agora o preço padrão." Anthropic, documentação oficial da plataforma Claude (tradução livre)


Por que a OpenAI cortou tão agressivamente

A CNBC reportou que a OpenAI enfrenta pressão de um base de clientes cada vez mais sensível a custo, com empresas relutantes em escalar IA sem uma visão clara de retorno sobre o investimento. O corte no Luna foi financiado por ganhos internos de eficiência de inferência: a própria OpenAI informou ter reduzido o custo de ponta a ponta do serviço em 20%, repassando esses ganhos ao cliente.

O resultado prático: a diferença entre o tier mais caro (Sol) e o mais barato (Luna) passou de 5x para 25x. Isso muda completamente a lógica de roteamento de requisições, que se torna o principal alavanca de custo na família GPT-5.6.


O que a Anthropic fez (e o que ainda preocupa)

A Anthropic não baixou o preço. Ela cancelou um aumento anunciado. São coisas diferentes e vale separar:

  • O Sonnet 5 lançou em junho de 2026 com preço "introdutório" de US$ 2/US$ 10, com vencimento previsto em 31 de agosto.
  • Em 10 de agosto, a Anthropic atualizou a documentação oficial confirmando que esse preço se torna permanente e que o aumento para US$ 3/US$ 15 (reajuste de 50%) não vai acontecer.
  • Quem já tinha ajustado o orçamento para absorver o reajuste de setembro pode reverter esse planejamento.

O ponto que ainda exige atenção: o Sonnet 5 roda em um tokenizador novo. A documentação da Anthropic indica que o mesmo texto de entrada pode gerar cerca de 30% mais tokens do que no Sonnet 4.6. O preço por token não subiu, mas o número de tokens por requisição pode ter aumentado. Quem migrou de versões anteriores precisa medir o consumo real antes de fechar orçamento.


O que isso muda no orçamento de quem já usa IA

Se você usa GPT (OpenAI)

O corte do Luna é real e imediato: projetos que rodavam em modelos mais antigos da família mini, por volume ou custo, agora têm uma opção de geração atual sem pagar mais. O risco está nos multiplicadores que o número do card-price não mostra:

  • Requisições acima de 272 mil tokens de entrada são cobradas a 2x na entrada e 1,5x na saída.
  • Endpoints regionais (para residência de dados) adicionam 10% sobre todos os modelos lançados a partir de 5 de março de 2026, o que inclui o GPT-5.6.
  • Fast mode no Sol custa 2x a taxa padrão.

Empilhar o pior caso no Sol resulta em até 4x o preço do card.

Se você usa Claude (Anthropic)

A boa notícia é que o orçamento de setembro já pode ser encerrado na linha dos preços atuais, sem necessidade de reserva para reajuste. A má notícia é que o tokenizador novo pode esconder um aumento real de custo disfarçado de "mesmas taxas". Se a sua aplicação foi construída medindo tokens por requisição no Sonnet 4.6, valide os números no Sonnet 5 antes de assumir paridade de custo.

Se você compra os dois (ou está avaliando)

A competição está forçando a convergência de preço na camada intermediária. O Sonnet 5 da Anthropic (US$ 2/US$ 10) agora compete diretamente com o Terra da OpenAI (US$ 2/US$ 12). Nesse patamar, a decisão deixa de ser só de preço de tabela e passa a ser de custo real por tarefa, que depende de tokenizador, tamanho de contexto e taxa de cache.


A armadilha maior: confundir preço de lista com custo de operação

Os dois anúncios criaram uma narrativa de "IA ficou mais barata". Pode ser verdade, pode não ser, dependendo do workload.

Os multiplicadores que não aparecem no título do comunicado de imprensa:

  1. Tokens de saída custam 6x o token de entrada em toda a família GPT-5.6. Aplicações que geram respostas longas são dominadas pelo custo de output.
  2. Cache write no GPT-5.6 custa 1,25x a taxa de entrada (não é gratuito como em gerações anteriores).
  3. O tokenizador do Sonnet 5 pode gerar 30% mais tokens do que o modelo anterior para o mesmo texto.
  4. Contextos longos têm pricing separado: no GPT-5.6, ultrapassar 272 mil tokens de entrada ativa uma taxa dobrada automaticamente.

Nenhum desses itens está na manchete dos comunicados. Todos aparecem na documentação técnica.


O que a Mutagex considera ao planejar custo de IA para clientes

Quando integramos modelos de linguagem em automações e agentes, o custo do modelo é uma variável, não uma constante. O orçamento correto parte de três números que o cliente precisa medir antes da decisão:

  • Tokens médios por requisição (entrada + saída + contexto de sistema).
  • Volume mensal de requisições (com pico e média, não só estimativa).
  • Taxa de cache (quanto do contexto se repete e pode ser cacheado).

Sem esses três números, qualquer projeção de custo baseada em preço de tabela é uma aposta.

Se você tem um agente ou automação rodando hoje e quer entender quanto vai custar escalar, o primeiro passo é o diagnóstico, que a Mutagex oferece gratuitamente em uma semana.