A Anthropic lançou o Claude Haiku 5.5 com preços mais baixos que os de seu antecessor, chamando-o de seu "modelo pequeno mais barato, rápido e capaz", capaz de lidar com fluxos de trabalho corporativos automatizados de alto volume.

Em uma declaração na quarta-feira, a empresa afirmou que o modelo custa, em média, cerca de 75% menos que o Haiku 4.5 e foi projetado para tarefas como resumos, consultas a bancos de dados, classificação e trabalho de subagentes. Ele também foi desenvolvido para aplicações sensíveis à velocidade, como atendimento ao cliente em tempo real e uso de navegadores.

O Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída para prompts de até 100.000 tokens. No entanto, os preços sobem para US$ 0,50 e US$ 2,50, respectivamente, para prompts maiores, informou a Anthropic.

O Haiku 5.5 também adiciona uma configuração de esforço ajustável à linha Haiku da Anthropic, permitindo que os usuários escolham entre custo e desempenho. Em testes internos, ele obteve 72,4% contra o subconjunto offline do benchmark de uso de computadores OSWorld 2.1. O Haiku 4.5 obteve 15,7%.

AI Benchmark Saturation Curves

AI Benchmark Saturation Curves

  • GPQA Diamond
  • MATH Level 5
  • OTIS Mock AIME 2024–2025
  • SWE-bench Verified (Epoch v2)
SOURCE: Epoch AI Benchmarking Hub

A Anthropic orientou os desenvolvedores a usar seus modelos maiores para trabalhos mais exigentes. O Sonnet 5.5 e o Opus 5.5 tiveram desempenho melhor no Terminal-Bench 4.0, no qual o Haiku 5.5 obteve 39,2%, contra 70,6% do Sonnet 5.5, informou a empresa.

A Anthropic também reduziu em 50% o preço das leituras de cache do Sonnet 5.5, para US$ 0,10 por milhão de tokens, ante US$ 0,20. A empresa afirmou que isso reduz em cerca de 20% o custo do Sonnet 5.5 na maioria das tarefas com agentes.