TecnologiaInteligência ArtificialNoticias

Claude Haiku 5.5 reduz custo de API e acelera agentes

A Anthropic lançou o Claude Haiku 5.5, modelo compacto voltado a operações em alto volume, com preços menores de API, controles de esforço e suporte para atuar como subagente. Segundo o anúncio repercutido em 7 de outubro de 2026, a novidade atende tarefas repetitivas como resumos, classificação, consultas a banco de dados, suporte ao cliente e uso de navegador em que velocidade e custo por token são decisivos. O modelo já pode ser chamado pelo identificador claude-haiku-5-5 na Claude Platform e em nuvens parceiras.

O principal corte está na faixa de até 100 mil tokens: US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída.

Preço do Claude Haiku 5.5: onde está a economia

Para prompts de até 100 mil tokens, o Claude Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. Leituras de cache saem por US$ 0,01, enquanto escritas de cache custam US$ 0,125 por milhão.

PUBLICIDADE

Acima desse limite, as tarifas são multiplicadas por cinco. A Anthropic afirma que, ao considerar as faixas e um tokenizador atualizado, o custo médio de execução fica cerca de 75% abaixo do Haiku 4.5. A empresa diz ainda que aproximadamente 90% das solicitações do modelo anterior já se enquadravam na faixa mais barata.

Item de APIPreço informadoCondição
EntradaUS$ 0,10/milhãoAté 100 mil tokens
SaídaUS$ 0,50/milhãoAté 100 mil tokens
Leitura de cacheUS$ 0,01/milhãoAté 100 mil tokens
Sonnet 5.5 cache readUS$ 0,10/milhãoNovo preço reportado

Desempenho para uso de computador, código e conhecimento

O avanço do Claude Haiku 5.5 não se limita ao preço. Nos números apresentados pela Anthropic, o modelo obteve 72,4% no subconjunto offline do OSWorld 2.1, ante 15,7% do Haiku 4.5. No Terminal-Bench 4.0, registrou 39,2%, enquanto o antecessor ficou em zero. Também alcançou 46,4% no FrontierCode 1.1 e 45,9% no Humanity’s Last Exam sem ferramentas; com ferramentas, esse último resultado foi a 57,4%.

O que muda com o ajuste de esforço

O ajuste de esforço permite escolher o equilíbrio entre custo, latência e capacidade de raciocínio. É a primeira vez que a linha Haiku recebe esse controle, útil quando uma aplicação mistura tarefas simples e exceções mais difíceis.

Esses benchmarks são indicadores fornecidos pela fabricante, não uma garantia de desempenho em cada fluxo de trabalho. Na prática, equipes devem testar precisão, tempo de resposta, taxa de erro e gasto real com os próprios dados. A própria Anthropic mantém Sonnet 5.5 e Opus 5.5 como opções para coding agêntico mais complexo; o Haiku fica posicionado para trabalhos delimitados, frequentes e escaláveis.

Onde o modelo está disponível e para que serve

O Claude Haiku 5.5 está disponível na Claude Platform, Amazon Web Services, Google Cloud e Microsoft Azure. Esse alcance facilita sua adoção em arquiteturas que já concentram dados, controles de acesso e faturamento em provedores de nuvem.

A função mais direta é processar muitas requisições com previsibilidade: resumir documentos, compactar contexto, classificar registros, responder tickets e consultar bases estruturadas. Em sistemas com múltiplos modelos, ele pode executar etapas auxiliares e encaminhar casos complexos a Sonnet ou Opus.

  • Resumos e compactação de contexto em escala.
  • Classificação e extração de dados de documentos.
  • Consultas a banco de dados com linguagem natural.
  • Atendimento ao cliente e triagem de tickets.
  • Subagentes para fluxos com Sonnet 5.5 ou Opus.

Créditos, SDK e limites de segurança

O lançamento também reduz pela metade o preço de leitura de cache do Sonnet 5.5, para US$ 0,10 por milhão de tokens. A Anthropic estima corte de cerca de 20% no custo da maior parte do trabalho agêntico. Assinantes Max 5x receberão US$ 100 mensais em créditos de API, usuários Max 20x terão US$ 200, e o plano Team poderá usar um pool de até US$ 500, sujeito às regras de elegibilidade da empresa.

Em paralelo, os SDKs de Python e TypeScript ganham suporte beta a computer use e browser use. Os recursos exigem que desenvolvedores forneçam seus próprios drivers de navegador ou desktop e implementem validações antes de ações sensíveis. As salvaguardas cibernéticas do Haiku permitem mais trabalho defensivo que o Sonnet 5.5, mas continuam bloqueando testes de invasão. Para usos em biologia, as proteções seguem o padrão indicado para Sonnet 5, Sonnet 5.5 e Opus 5.

Como avaliar se o Haiku 5.5 cabe no seu projeto

  1. Meça quantos prompts ficam abaixo de 100 mil tokens.
  2. Compare qualidade com o Haiku 4.5 em tarefas reais.
  3. Teste cache, latência e taxa de escalonamento para modelos maiores.
  4. Defina aprovação humana para browser use e computer use.

O ganho tende a ser maior quando o volume é alto e a tarefa é bem definida. Já fluxos de planejamento extenso, programação autônoma complexa ou decisões de alto risco pedem avaliação adicional, roteamento para modelos mais capazes e controles de segurança.

Perguntas frequentes sobre Claude Haiku 5.5

  1. Quanto custa o Claude Haiku 5.5?

    Até 100 mil tokens, custa US$ 0,10 por milhão de entrada e US$ 0,50 de saída. Leituras de cache custam US$ 0,01. Acima do limite, as tarifas aumentam cinco vezes.

  2. Onde usar o modelo claude-haiku-5-5?

    O modelo está na Claude Platform, AWS, Google Cloud e Microsoft Azure. A disponibilidade facilita a integração em infraestruturas já hospedadas nesses provedores.

  3. Haiku 5.5 substitui Sonnet 5.5?

    Não necessariamente. O Haiku 5.5 é indicado para tarefas estreitas, rápidas e repetitivas. A Anthropic mantém Sonnet e Opus para coding agêntico mais complexo.

  4. Quais créditos de API chegam aos assinantes?

    Max 5x recebe US$ 100 mensais, Max 20x recebe US$ 200 e o Team pode ter até US$ 500 compartilhados. É preciso conferir elegibilidade no suporte oficial.

Considerações finais

O Claude Haiku 5.5 reforça a disputa por IA mais barata para produção. Ao combinar preço reduzido de API, melhor desempenho em uso de computador e créditos para assinantes, a Anthropic mira empresas que precisam automatizar grande volume sem levar todo pedido aos modelos mais caros. Antes de migrar, valide os benchmarks no seu caso de uso, monitore o consumo de tokens e trate recursos de navegador como operações supervisionadas.


Fontes: anúncio da Anthropic, documentação de browser

Diogo Fernando

Apaixonado por tecnologia e cultura pop, programo para resolver problemas e transformar vidas. Empreendedor e geek, busco novas ideias e desafios. Acredito na tecnologia como superpoder do século XXI.