Anthropic lança Claude Haiku 5.5 com redução de 75% nos custos operacionais

75% mais barato, até 90% para solicitações pequenas
O Claude Haiku 5.5 reduz drasticamente os custos operacionais em relação ao modelo anterior.
Mark

Por que a Anthropic lançou especificamente um modelo "pequeno" agora? Não tinham isso antes?

Mimi

Tinham o Haiku 4.5, mas ele era bem mais caro de operar. O novo é 75% mais barato em média, e até 90% mais barato para solicitações pequenas. A ideia é que muitas empresas não precisam de um Opus ou Sonnet para tudo — resumir um documento, classificar dados, responder perguntas simples. O Haiku 5.5 faz isso muito mais barato.

Luke

Mas esses números de desempenho — 72,4% no OSWorld, 39,2% no Terminal-Bench — são testes que a própria Anthropic rodou e publicou. Não há avaliação independente. Precisamos ser cuidadosos em dizer que o modelo é "melhor" sem saber se esses benchmarks são representativos do mundo real.

Mark

Entendi. E quanto ao custo real? R$ 0,53 por milhão de tokens de entrada soa barato, mas o que isso significa na prática?

Mimi

Um milhão de tokens é muito. Para colocar em perspectiva, um livro tem cerca de 100 mil tokens. Então R$ 0,53 é o custo para processar dez livros. Para a maioria das aplicações — chatbots, resumos, classificação — você está falando de centavos por requisição.

Luke

Verdade, mas isso só vale para solicitações de até 100 mil tokens. Acima disso, o preço sobe dez vezes. A Anthropic diz que 90% das requisições ao Haiku 4.5 estavam abaixo desse limite, mas não sabemos se isso será verdade para o 5.5 ou em todos os casos de uso.

Mark

O que é esse sistema de "esforço ajustável" que mencionaram?

Mimi

É a primeira vez que o Haiku oferece isso. Basicamente, você pode dizer ao modelo: "Pense rápido e barato" ou "Pense mais, use mais tokens, seja mais preciso". Desenvolvedores podem calibrar conforme a tarefa. Uma pergunta simples não precisa de muito raciocínio; uma complexa sim.

Luke

Mas a Anthropic não publicou dados sobre quanto tempo ou custo cada nível de esforço consome. É uma funcionalidade interessante, mas ainda não temos números concretos sobre o trade-off.

Mark

E a segurança? Ficou melhor?

Mimi

A Anthropic afirma que sim. Menos comportamentos desalinhados, menos disposição para colaborar com usos indevidos. As proteções de cibersegurança são mais rígidas que no 4.5, mas ainda permitem tarefas defensivas legítimas.

Luke

Novamente, são afirmações da própria empresa. Não há teste de segurança independente publicado. Sabemos que as salvaguardas de biologia seguem o padrão do Sonnet 5 e Opus 5, mas o que exatamente isso significa em termos de restrições reais?

Mark

Qual é o grande jogo aqui? Por que agora?

Mimi

A Anthropic está completando sua linha Claude 5.5 em duas semanas. Quer oferecer opções para cada caso de uso — Opus para o mais complexo, Sonnet para o meio termo, Haiku para volume e economia. E está oferecendo créditos de API para assinantes Max e Team para estimular o desenvolvimento de aplicativos.

Luke

É uma estratégia clara de capturar mercado em diferentes segmentos. Mas o que não sabemos é se essa redução de custo é sustentável ou se é uma jogada de preço agressiva para ganhar participação de mercado antes de aumentar depois.

  • O custo de operar IA em larga escala ainda afasta desenvolvedores e empresas de menor porte — e o Haiku 5.5 chega diretamente para atacar esse obstáculo.
  • A redução de até 90% nos preços para as solicitações mais comuns representa uma mudança concreta na viabilidade econômica de aplicações em escala.
  • O salto de desempenho é expressivo: no benchmark OSWorld 2.1, o modelo passou de 15,7% para 72,4%, superando também o GPT-6 Luna da OpenAI.
  • Níveis ajustáveis de esforço chegam pela primeira vez à categoria Haiku, permitindo que desenvolvedores calibrem velocidade, custo e capacidade conforme a complexidade de cada tarefa.
  • Com créditos mensais de API para assinantes e suporte em AWS, Google Cloud e Azure, a Anthropic acelera a adoção do modelo em ambientes de produção.

Em um mercado onde o custo da inteligência artificial ainda é barreira para muitos desenvolvedores, a Anthropic apresentou o Claude Haiku 5.5 — um modelo projetado não para impressionar com grandiosidade, mas para servir com eficiência. Com preços até 75% menores que seu antecessor e desempenho notavelmente superior em benchmarks de agentes, o lançamento sugere que a democratização da IA passa menos por modelos maiores e mais por modelos mais sábios no uso de recursos. A família Claude 5.5 se completa, e com ela a promessa de que escala e economia podem coexistir.

A Anthropic lançou o Claude Haiku 5.5, completando a família Claude 5.5 — que já incluía Opus e Sonnet — em pouco mais de duas semanas de atualizações. O modelo foi concebido para aplicações que exigem velocidade e processamento em volume, sem os custos associados aos modelos mais robustos da empresa.

O destaque central é o preço: em média 75% menor que o Haiku 4.5. Para solicitações de até 100 mil tokens — faixa que cobre cerca de 90% dos usos do modelo anterior — a economia chega a 90%, com custo de US$ 0,10 por milhão de tokens de entrada. A Anthropic também reduziu pela metade o preço de leitura de cache do Sonnet 5.5, diminuindo em cerca de 20% os custos para tarefas com agentes de IA.

Entre os casos de uso previstos estão resumos de texto, classificação, consultas a bancos de dados e atendimento ao cliente em tempo real. Uma novidade técnica é o sistema de níveis ajustáveis de esforço — inédito na categoria Haiku — que permite aos desenvolvedores calibrar quanto raciocínio o modelo aplica antes de responder, equilibrando velocidade e capacidade conforme a tarefa.

Nos benchmarks internos, os resultados são expressivos. No OSWorld 2.1, o Haiku 5.5 alcançou 72,4%, contra 15,7% do modelo anterior e 48,9% do GPT-6 Luna da OpenAI. No Terminal-Bench 4.0, chegou a 39,2%, enquanto o Haiku 4.5 havia registrado 0%. Vale notar que esses dados foram produzidos pela própria Anthropic, sem avaliação independente.

Em segurança, a empresa afirma ter reduzido episódios de desalinhamento e reforçado proteções de cibersegurança, mantendo uma gama de tarefas defensivas sem permitir testes de invasão. Assinantes dos planos Max e Team também passam a receber créditos mensais de API para estimular o desenvolvimento de aplicativos. O modelo já está disponível na Claude Platform e nos principais provedores de nuvem.

A Anthropic apresentou nesta quarta-feira o Claude Haiku 5.5, um modelo de inteligência artificial projetado para trabalhos que demandam velocidade, processamento em larga escala e orçamentos enxutos. O lançamento completa a família Claude 5.5, que já incluía as versões Opus e Sonnet, e marca a conclusão de uma atualização de linha que levou pouco mais de duas semanas.

O grande destaque é o preço. O Haiku 5.5 custa em média 75% menos para operar do que seu antecessor, o Haiku 4.5. Para solicitações de até 100 mil tokens — o limite que abrange cerca de 90% dos usos do modelo anterior — a economia chega a 90%. Nesse patamar, o custo é de US$ 0,10 por milhão de tokens de entrada, o equivalente a R$ 0,53, e US$ 0,50 por milhão de tokens de saída, ou R$ 2,65. Acima desse limite, os preços sobem para US$ 0,50 e US$ 2,50 por milhão de tokens, respectivamente. A Anthropic também cortou pela metade o preço de leitura de cache do Sonnet 5.5, reduzindo custos em cerca de 20% para a maioria das tarefas que usam agentes de IA.

O modelo foi desenvolvido para aplicações que precisam processar grandes volumes de solicitações sem necessariamente recorrer aos modelos maiores da empresa. A Anthropic lista como casos de uso resumos de texto, compactação de contexto, consultas a bancos de dados e classificação. Também é adequado para tarefas sensíveis ao tempo, como atendimento ao cliente em tempo real e navegação na web. Desenvolvedores podem usá-lo como um subagente ao lado de modelos mais poderosos, especialmente em trabalhos de programação. A empresa afirma que o Haiku 5.5 é seu modelo mais rápido até agora em velocidade padrão.

Uma novidade técnica é o sistema de níveis ajustáveis de esforço, primeira vez que a categoria Haiku oferece essa funcionalidade. A configuração permite que desenvolvedores escolham quanto raciocínio o modelo deve usar antes de responder, equilibrando velocidade e custo em tarefas simples ou aumentando o esforço quando a complexidade exige mais capacidade. O modelo possui uma janela de contexto de um milhão de tokens.

Nos testes internos da Anthropic, o Haiku 5.5 demonstrou saltos significativos de desempenho. No OSWorld 2.1, um benchmark que mede a capacidade de agentes operarem um computador para realizar tarefas complexas, alcançou 72,4%, contra 15,7% do Haiku 4.5. No Terminal-Bench 4.0, voltado a tarefas de programação em terminal, chegou a 39,2%, enquanto o modelo anterior havia registrado 0%. No teste Humanity's Last Exam, obteve 45,9% sem ferramentas e 57,4% com ferramentas, comparado a 10,2% e 18,7% do Haiku 4.5. A Anthropic também apresentou comparações com modelos da OpenAI, mostrando o Haiku 5.5 com 72,4% no OSWorld 2.1 contra 48,9% do GPT-6 Luna, e 39,2% no Terminal-Bench 4.0 contra 16,4%. Esses resultados foram divulgados pela própria Anthropic e refletem sua metodologia de teste, não uma avaliação independente.

Em segurança, a empresa afirma ter melhorado o comportamento do Haiku 5.5 em relação ao Haiku 4.5, com menos episódios de desalinhamento e menor disposição para colaborar com usos indevidos. As proteções de cibersegurança são mais rígidas que no modelo anterior, mas menos restritivas que nos modelos mais recentes da empresa, permitindo uma gama maior de tarefas defensivas enquanto bloqueia testes de invasão. As salvaguardas relacionadas à biologia seguem o padrão do Sonnet 5, Sonnet 5.5 e Opus 5.

Com o lançamento, a Anthropic também anunciou créditos mensais de API para assinantes. Usuários do plano Max 5x receberão US$ 100 por mês, enquanto assinantes do Max 20x terão US$ 200. Clientes Team ganham US$ 500 em créditos compartilhados. Os créditos funcionam com qualquer modelo da Anthropic e foram criados para estimular o desenvolvimento de aplicativos e agentes. A empresa atualizou seus SDKs de Python e TypeScript com suporte beta para uso de computador e navegador.

O Claude Haiku 5.5 já está disponível nas plataformas da Anthropic, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. Na Claude Platform, desenvolvedores podem acessá-lo como claude-haiku-5-5. Com essa versão, a Anthropic posiciona o Haiku como a opção mais econômica da família Claude 5.5, enquanto Sonnet e Opus permanecem direcionados a tarefas mais complexas.

O Haiku 5.5 é seu modelo pequeno mais rápido, barato e capaz até agora
— Anthropic
Cerca de 90% das solicitações feitas ao Haiku 4.5 estavam dentro do limite de 100 mil tokens
— Anthropic
Contact Us FAQ