A OpenAI reduziu os preços do desenvolvedor para seu modelo de fronteira GPT-5.6 Sol em mais de 20%, informou a Reuters na sexta-feira, encerrando meses de resistência enquanto os concorrentes diminuíam o prêmio do carro-chefe. A mudança reduz o modelo mais capaz da OpenAI para US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída no nível padrão, de acordo com a página oficial de preços da empresa – uma queda significativa em relação às taxas de entrada de US$ 5 e US$ 30 de saída que a Sol realizou desde o lançamento. É o sinal mais claro de que a guerra de preços da IA ​​atingiu o topo da pilha de modelos, uma mudança que temos vindo a acompanhar na nossa cobertura da economia da indústria da IA.

Os números por trás do corte

Os novos preços listados na documentação da plataforma OpenAI mostram GPT-5.6 Sol a US$ 4,00 por milhão de tokens de entrada, US$ 0,40 para entrada em cache, US$ 5,00 para gravações em cache e US$ 20,00 por milhão de tokens de saída para solicitações de contexto curto. Solicitações de contexto longo agora executam entrada de US$ 8,00 e saída de US$ 30,00. Isso representa uma redução de 20% nos insumos e um corte de 33% na produção em relação ao preço de lançamento do modelo de US$ 5 e US$ 30.

A OpenAI também está oferecendo preços promocionais do Sol a US$ 2,00 de entrada e US$ 10,00 de saída – metade da nova taxa padrão – que a empresa afirma estar disponível pelo menos até 21 de novembro de 2026. Os níveis de lote e flexíveis caem ainda mais, começando com US$ 2,00 de entrada e US$ 10,00 de saída para agendamento flexível.

Um carro-chefe que resistiu - até agora

O corte reverte uma estratégia deliberada. Quando a OpenAI reduziu os preços da família GPT-5.6 em 30 de julho, cortou o pequeno modelo Luna em 80%, para US$ 0,20 de entrada e US$ 1,20 de saída, e reduziu o nível intermediário Terra em 20%, para US$ 2 e US$ 12 – mas deixou Sol intocado, argumentando que as capacidades do carro-chefe justificavam o preço de fronteira.

Três semanas de pressão do mercado parecem ter mudado o cálculo. Claude Opus 5 da Anthropic lista entradas de US$ 5 e saída de US$ 25, reduzindo a antiga taxa de produção de US$ 30 da Sol, enquanto Claude Sonnet 5 está disponível com entrada introdutória de US$ 2 e saída de US$ 10 até 31 de agosto antes de passar para US$ 3 e US$ 15. Os laboratórios chineses reduziram ambos: o V4 Pro 0813 da DeepSeek está listado com cerca de US$ 0,435 de entrada e US$ 0,87 de saída por milhão de tokens por meio de plataformas de roteamento, e o Kimi K3 da Moonshot AI por US$ 2,80 e US$ 14.

Rota dos desenvolvedores, eles não se casam

Para as equipes de engenharia, o preço do modelo tornou-se uma decisão de roteamento. Uma pilha corporativa típica pode enviar o trabalho mais difícil de codificação e raciocínio para um modelo de fronteira, tarefas rotineiras para um modelo intermediário e trabalhos repetitivos de alto volume para a opção mais barata. Quando os tokens de produção do carro-chefe custam 30 vezes mais do que os de um rival confiável, as equipes financeiras começam a perguntar quais solicitações realmente merecem o prêmio.

A mudança de comportamento já é visível. A Fortune informou em julho que o cofundador e CTO da DoorDash, Andy Fang, disse que a Moonshot AI oferecia “melhor qualidade” a um “custo mais barato” para um dos experimentos de IA da empresa, e que Airbnb e Siemens estavam testando fornecedores chineses, incluindo Alibaba e DeepSeek, à medida que as contas de IA disparavam.

A Reuters vinculou o corte de sexta-feira a essa pressão competitiva, observando que a OpenAI está trabalhando para manter os desenvolvedores ancorados em sua plataforma enquanto rivais – incluindo a Anthropic, que está preparando um IPO de grande sucesso – pressionam de todas as direções. OpenAI ultrapassou um bilhão de usuários no início deste verão, após seus cortes de preços em julho, e a empresa argumentou que o custo de inferência é agora uma estratégia de produto, em vez de encanamento de back-office, creditando melhor roteamento de hardware, software de inferência aprimorado e cache de contexto mais inteligente por sua capacidade de reduzir taxas.

O que isso significa para o mercado

Para OpenAI, o corte Sol protege o fosso onde é mais tênue: cargas de trabalho de desenvolvedor que podem se mover entre APIs com uma mudança de configuração. O nível promocional até novembro parece uma ferramenta de retenção agressiva voltada para o ciclo de avaliação que as empresas executam antes de comprometer o tráfego de produção.

Para o mercado mais amplo, um concorrente abaixo de US$ 1, uma opção de fronteira intermediária de US$ 14 e um carro-chefe agora de US$ 20 sinalizam que os preços dos tokens estão caindo mais rápido do que a maioria das previsões para 2025 previa – mesmo com o aumento dos custos de treinamento para modelos de fronteira. Os laboratórios estão efectivamente a subsidiar a inferência para defender a partilha do ecossistema, uma dinâmica que favorece as empresas com os bolsos mais fundos e a maior distribuição.

A resposta da Antrópica será acompanhada de perto. Com o seu IPO visando um aumento de até 100 mil milhões de dólares, de acordo com o The New York Times, a empresa tem todos os incentivos para manter a sua vantagem de preço visível. Google, Meta e os laboratórios chineses têm, cada um, seus próprios cortes a serem considerados.

Para os desenvolvedores, o conselho é simples: os preços mudam semanalmente e a fatura que você orçou no mês passado já está obsoleta. Bloquear a arquitetura em torno da tabela de preços de um único fornecedor é agora um risco em si - camadas de roteamento que podem mudar o tráfego entre modelos à medida que os preços mudam se tornaram infraestrutura padrão, uma tendência acelerada pela aquisição do OpenRouter pela Stripe esta semana.

Fique à frente da IA

Os preços dos modelos, os lançamentos e as guerras de benchmark avançam a uma velocidade vertiginosa. AI Buzz Wire fornece diariamente notícias de IA verificadas na fonte – números precisos, fontes reais, zero exageros.

Leia mais notícias sobre modelos de IA →