ModelosEm alta

Anthropic corta custo do Claude Haiku 5.5 em 75%

A Anthropic lançou o Haiku 5.5, seu modelo pequeno mais barato de operar até agora. Além de mover a peça mais pesada do custo, a empresa cortou pela metade o preço da leitura de cache do Sonnet 5.5.

Mariana SilvaMariana Silva
Popularidade: 1,500
Anthropic corta custo do Claude Haiku 5.5 em 75%

A Anthropic lançou o Haiku 5.5, seu modelo pequeno mais barato de operar até agora. Além de mover a peça mais pesada do custo, a empresa cortou pela metade o preço da leitura de cache do Sonnet 5.5.

O que a Anthropic mudou no Claude Haiku 5.5

A Anthropic apresentou o Claude Haiku 5.5 em 7 de outubro de 2026, o terceiro integrante da família Claude 5.5, depois de Opus 5.5 e Sonnet 5.5. A empresa descreve o modelo como o mais rápido e "mais capaz" que já lançou na categoria pequena. O recado central, porém, é outro: operar o Haiku ficou bem mais barato. Bem mais barato mesmo.

Segundo a Anthropic, o custo médio de execução do Haiku 5.5 é cerca de 75% menor do que o do Haiku 4.5. Em prompts de até 100 mil tokens, o corte por token chega a 90%. É uma queda e tanto para um modelo que roda em volume. E volume é exatamente onde ele trabalha.

O Haiku 5.5 já pode ser selecionado por usuários Free, Pro, Max, Team e Enterprise no Claude.ai, disponível na web, no iOS e no Android. Para quem desenvolve, o modelo chegou em paralelo à plataforma Claude, à AWS, ao Google Cloud e ao Microsoft Foundry, e também no Claude Code.

Preço do Haiku 5.5: como ficou a conta

O preço mudou de acordo com o tamanho do prompt. Vale entender a diferença, porque é o coração da notícia.

Para prompts de até 100 mil tokens, o Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. Acima desse limite, os valores sobem para US$ 0,50 de entrada e US$ 2,50 de saída por milhão de tokens.

A Anthropic diz que cerca de 90% das chamadas feitas ao Haiku 4.5 já cabiam dentro do teto de 100 mil tokens. Isso significa que a maior parte dos usuários vai sentir o corte mais agressivo no bolso, e não o preço mais alto reservado aos prompts longos.

O ganho real aparece quando o volume cresce. Um aplicativo que faz milhares de resumos por dia, ou que classifica mensagens em tempo real, paga por cada requisição. Reduzir 75% do custo médio de operação muda a viabilidade dessas tarefas. Faz diferença. No fim do mês, a conta cai.

Haiku 5.5

  • Até 100K tokens: US$ 0,10 entrada / US$ 0,50 saída
  • Acima de 100K: US$ 0,50 entrada / US$ 2,50 saída
  • Custo médio 75% menor que o Haiku 4.5
  • Mesmo preço em todas as nuvens parceiras

Haiku 4.5

  • Lançado em outubro de 2025
  • Preço por token até 90% mais alto no trecho curto
  • Antecessor direto na linha pequena
  • Ainda disponível, sem data de desligamento

O Sonnet 5.5 também ficou mais barato no cache

O corte não ficou só no modelo pequeno. A Anthropic reduziu pela metade o preço de leitura de cache do Claude Sonnet 5.5, que agora sai por US$ 0,10 por milhão de tokens.

Para quem não está familiarizado com o termo, cache de prompt é um recurso em que o modelo guarda um trecho que você vai repetir várias vezes, como um manual interno ou um conjunto de instruções fixas. Em vez de reprocessar tudo a cada chamada, ele reaproveita o que já está salvo. Isso reduz muito o tempo e o custo em aplicações que fazem perguntas diferentes sobre o mesmo material.

Com o cache mais barato, produtos que consultam a mesma base de documentos toda hora, como assistentes de atendimento ou ferramentas de busca interna, ficam mais em conta de operar. O Haiku 5.5 também aceita até 90% de economia usando cache e 50% com processamento em lote. Vale a pena configurar isso.

Para que serve um modelo pequeno como o Haiku 5.5

Modelos pequenos não competem com os maiores em tarefas difíceis, e a Anthropic não tenta vender isso. O Haiku 5.5 é pensado para trabalho repetitivo e sensível à velocidade.

Entre os usos citados pela empresa estão resumo de textos, compactação de contexto, consultas a bancos de dados e classificação. O modelo também aparece como subagente ao lado de Sonnet 5.5 ou Opus 5.5, cuidando das etapas simples para deixar o modelo maior focado no que exige mais raciocínio. Em atendimento ao cliente e navegação na web, onde a resposta precisa sair rápido, ele preenche a mesma lacuna.

O Haiku 5.5 marcou 43 pontos no índice de inteligência da Artificial Analysis, uma referência de mercado que mede o desempenho geral de modelos. É um número de modelo pequeno, não de topo de linha. A aposta é que, para boa parte das tarefas diárias, esse nível já basta. Vale a pena trocar um modelo grande por um pequeno em tudo? Nem sempre, e a Anthropic sabe disso.

O que muda para quem usa Claude

Se você já usa o Claude no dia a dia, o Haiku 5.5 entra como a opção mais econômica para tarefas em que a qualidade máxima não é obrigatória. Resumir um documento longo, extrair dados de uma planilha ou responder perguntas simples não precisam do Opus. Não force a máquina grande. Não force a máquina grande.

Para desenvolvedores, a conta muda de forma mais direta. Fluxos com muitas chamadas, que antes ficavam caros no Haiku 4.5, agora cabem em orçamentos menores. Vale revisar quais partes do seu produto rodam no modelo pequeno e quais ainda precisam de um modelo grande.

A Anthropic não informou se o Haiku 4.5 será descontinuado. O Haiku 5.5 já está disponível no Claude.ai e nas plataformas de nuvem parceiras, então dá para testar agora e medir o custo real no seu próprio caso antes de migrar de vez. Faça a conta antes.

Compartilhar esta notícia

Produtos mencionados

Fontes

Notícias de IA relacionadas

Receita da OpenAI fica US$ 20 bilhões abaixo do informado a investidores
Negócios e indústria

Receita da OpenAI fica US$ 20 bilhões abaixo do informado a investidores

Segundo o Financial Times, a OpenAI comunicou a investidores que sua receita anualizada está perto de US$ 50 bilhões, cerca de US$ 20 bilhões abaixo do número que circulava há poucas semanas. A diferença vem de uma comparação que nunca foi justa, e o mercado reagiu na hora.

Popularidade: 74
Google Cloud lança Gemini agent para executar tarefas no trabalho
Produto

Google Cloud lança Gemini agent para executar tarefas no trabalho

O Google Cloud apresentou o Gemini agent, um assistente de IA que deixa de só responder perguntas e passa a executar tarefas por conta própria. Ele estreia para empresas e chama atenção por poder escolher modelos de fora do Google, começando pelo Claude.

Popularidade: 82
Anthropic proíbe abuso contra o modelo em nova política de uso
Negócios e indústria

Anthropic proíbe abuso contra o modelo em nova política de uso

A Anthropic atualizou sua Política de Uso pela primeira vez em mais de um ano e, pela primeira vez, passou a proibir explicitamente o "abuso" contra seus próprios modelos. A regra vale só em casos extremos, mas a empresa também reescreveu toda a parte sobre eleições.

Popularidade: 78
Anthropic lança OSS Scanner gratuito para caçar falhas em código aberto
Produto

Anthropic lança OSS Scanner gratuito para caçar falhas em código aberto

A Anthropic abriu o OSS Scanner, um serviço gratuito que usa seus modelos mais fortes para caçar falhas de segurança em projetos de código aberto. O projeto nasce de uma constatação incômoda: a IA encontra vulnerabilidades mais rápido do que humanos conseguem revisar.

Popularidade: 70