A Anthropic lançou Claude Haiku 5.5 na terça-feira, descrevendo-o como “o modelo pequeno mais barato, mais rápido e mais capaz que já lançamos”. O lançamento vem com um corte acentuado de preços em dois níveis que reduz os custos de entrada para US$ 0,10 por milhão de tokens para a maioria das solicitações, um movimento que coloca pressão direta sobre o GPT-6 Luna da OpenAI no segmento de modelos pequenos e estende uma guerra de preços de meses em toda a indústria de IA.
O anúncio, publicado no site da Anthropic em 7 de outubro de 2026, posiciona o Haiku 5.5 como o terceiro modelo da família Claude 5.5, ao lado do Sonnet 5.5 e do Opus 5.5. A Reuters caracterizou o lançamento como a Anthropic expandindo sua linha de modelos enquanto se prepara para um IPO planejado, e o modelo já está disponível no GitHub Copilot, Amazon Web Services, Google Cloud e Microsoft Foundry. O lançamento é a última entrada em um mês de notícias de última hora sobre IA que viu lançamentos de modelos, cortes de preços e movimentos políticos chegarem quase todos os dias.
Um modelo pequeno construído para trabalhos de alto volume
De acordo com a Anthropic, Claude Haiku 5.5 foi projetado para tarefas de alto volume e sensíveis ao custo, em vez de raciocínio de nível de fronteira. A empresa afirma que “lida de forma confiável com cargas de trabalho rápidas e repetitivas”, como resumos, compactação, consultas de banco de dados e solicitações de classificação.
A Anthropic também posiciona o novo modelo como um companheiro para seus sistemas maiores: o Haiku 5.5 “combina bem com o Opus 5.5 e o Sonnet 5.5 como um subagente no trabalho de codificação”, permitindo que os desenvolvedores encaminhem subtarefas baratas e rápidas para o Haiku, enquanto reservam modelos maiores para raciocínio complexo. Por ser o modelo mais rápido da Anthropic até o momento em velocidade padrão, a empresa o recomenda para aplicações sensíveis à latência, como suporte ao cliente ao vivo e uso de navegador. Uma nota de rodapé acrescenta uma advertência: os modelos Opus da Anthropic ainda funcionam mais rápido no Modo Rápido.
Preço: até 90% mais barato que o Haiku 4.5
A mudança do título é o preço. A Anthropic diz que o Haiku 5.5 custa cerca de 75% menos para ser executado do que o Haiku 4.5, em média, com uma estrutura em camadas que depende do tamanho do prompt.
Para solicitações com solicitações de até 100.000 tokens – que a Anthropic afirma ter sido responsável por cerca de 90% das solicitações para o modelo anterior do Haiku – os preços são 90% mais baixos do que o Haiku 4.5. Solicitações acima de 100.000 tokens custam 50% menos.
A tabela de preços por milhão de tokens do anúncio da Anthropic mostra a escala do corte:
- Tokens de entrada: US$ 0,10 (solicitações de até 100 mil) ou US$ 0,50 (acima de 100 mil), abaixo dos US$ 1,00 fixos do Haiku 4.5
- Tokens de saída: US$ 0,50 ou US$ 2,50, abaixo dos US$ 5,00
- Leituras do cache: US$ 0,01 ou US$ 0,05, abaixo dos US$ 0,10
- Gravações em cache: US$ 0,125 ou US$ 0,625, abaixo dos US$ 1,25
No nível abaixo de 100K, isso faz com que o preço de saída do Haiku 5.5 seja um quinto dos US$ 10,00 por milhão de tokens de saída do Sonnet 5.5.
A Anthropic observa um detalhe técnico por trás dos números: o Haiku 5.5 usa um tokenizer atualizado, semelhante ao Sonnet 5.5 e Opus 5.5, o que significa que ele usa um pouco mais tokens por tarefa do que o Haiku 4.5. A empresa afirma que seu cálculo de custo médio leva em conta essa diferença.
Benchmarks: à frente do GPT-6 Luna na maioria das linhas
A Anthropic publicou uma tabela de benchmark comparando o Haiku 5.5 com o Haiku 4.5, GPT-6 Luna e Sonnet 5.5. Na maioria das avaliações listadas, o novo modelo termina à frente do Luna e dramaticamente à frente do seu antecessor:
- GDPval-AA v2.1 (trabalho de conhecimento): 1.620 para Haiku 5.5, versus 735 para Haiku 4.5, 1.437 para GPT-6 Luna e 1.840 para Sonnet 5.5
- AA-Briefcase v1.1: 1578, versus 614 para Haiku 4.5 e 1336 para Luna
- OSWorld 2.1, subconjunto offline (uso do computador): 72,4%, versus 15,7% para Haiku 4.5, 48,9% para Luna e 83,9% para Sonnet 5.5
- Último Exame da Humanidade: 45,9% sem ferramentas e 57,4% com ferramentas, contra 10,2% e 18,7% do Haiku 4.5
- Terminal-Bench 4.0 (codificação agente): 39,2%, contra 16,4% para Luna e 70,6% para Sonnet 5.5
- FrontierCode 1.1, Principal: 46,4%, à frente dos 42,4% de Luna
O padrão é consistente: o Haiku 5.5 fecha grande parte da lacuna para o GPT-6 Luna e, no uso do computador, supera-o completamente, enquanto o próprio Sonnet 5.5 da Anthropic ainda lidera todas as categorias. A orientação da Anthropic reflete essa hierarquia – a empresa diz que o Sonnet 5.5 e o Opus 5.5 “continuam sendo melhores escolhas para tarefas complexas de codificação de agentes, como aquelas medidas pelo Terminal-Bench 4.0”, enquanto o Haiku 5.5 tem como alvo trabalhos de escopo restrito que “de outra forma poderiam ter sido de custo proibitivo com versões anteriores do Claude”.
Primeiro Haiku com Dial de Esforço
O Haiku 5.5 também é o primeiro modelo da classe Haiku a ser fornecido com uma configuração de esforço ajustável, o controle de custo versus inteligência que a Anthropic oferecia anteriormente em seus modelos maiores. Os usuários podem escolher quanto de computação cada solicitação consome, e os gráficos da Anthropic mostram pontuações de benchmark em cada nível de esforço, de Baixo a Máximo.
Postura de segurança: mais rígida que o Haiku 4.5, mais solta que o Soneto
Sobre segurança, a Anthropic diz que o Haiku 5.5 mostra “grandes melhorias em quase todas as nossas avaliações de alinhamento em relação ao Haiku 4.5”, com muito menos casos de comportamento desalinhado e uma menor disposição para cooperar com o uso indevido.
As salvaguardas de segurança cibernética do modelo são mais restritivas do que as do Haiku 4.5, embora um pouco menos restritivas do que as dos modelos maiores recentes da Anthropic. Eles permitem uma gama mais ampla de tarefas de segurança defensivas do que as salvaguardas do Sonnet 5.5, mas ainda bloqueiam testes de penetração e técnicas com maior probabilidade de serem usadas por invasores. As salvaguardas biológicas correspondem às do Sonnet 5, Sonnet 5.5 e Opus 5. As organizações que precisam de acesso mais amplo podem se inscrever nos Programas de Ciências da Vida ou de Verificação Cibernética da Anthropic. Detalhes completos estão na placa do sistema Haiku 5.5.
O resto do anúncio: Soneto mais barato, créditos de API gratuitos
O lançamento foi embalado com várias outras mudanças. As leituras de cache no Claude Sonnet 5.5 agora custam US$ 0,10 por milhão de tokens em vez de US$ 0,20 – um corte de 50% que a Anthropic diz tornar o Sonnet 5.5 cerca de 20% mais barato na maioria dos trabalhos de agente, uma vez que as leituras de cache dominam o consumo de tokens nos fluxos de trabalho dos agentes.
A Anthropic também está lançando créditos API mensais esta semana para clientes de assinatura: US$ 100 por mês para usuários Max 5x, US$ 200 para usuários Max 20x e até US$ 500 agrupados entre usuários para planos Team, utilizáveis em qualquer modelo. Os créditos são destinados a assinantes que constroem ferramentas e agentes na Plataforma Claude.
Os desenvolvedores também recebem atualizações do SDK: os SDKs Python e TypeScript da Anthropic agora suportam o uso do computador e do navegador em beta, recursos que a empresa diz se adequarem ao perfil de velocidade e preço do Haiku 5.5.
Uma guerra de preços sem fim à vista
A cobertura do Decoder enquadrou o lançamento como prova de que “a corrida armamentista aos preços da IA está longe de terminar”, e os números apoiam essa leitura. Em setembro, a Anthropic e a OpenAI lançaram modelos rivais com poucas horas de diferença, completos com reduções de preços concorrentes. O Haiku 5.5 estende essa batalha ao segmento inferior do mercado, onde modelos pequenos alimentam as cargas de trabalho de maior volume e mais sensíveis ao preço.
Para os desenvolvedores, o efeito imediato é direto: a inferência de modelos pequenos na plataforma Claude agora começa em US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, com o GPT-6 Luna superado na maioria dos benchmarks publicados da Anthropic nessa faixa de preço. Se a OpenAI responder com um corte de preço do Luna – ou esperar pelo lançamento de seu próximo modelo pequeno – sinalizará o quão durável esse preço mínimo realmente é.
O Haiku 5.5 já está disponível nos aplicativos e APIs originais da Anthropic, Amazon Web Services, Google Cloud e Microsoft Foundry, e já está integrado ao GitHub Copilot.
Fique à frente da IA Leia mais notícias sobre IA no AI Buzz Wire