Anthropic lança Claude Haiku 5.5 com foco em velocidade e menor custo para tarefas de IA

Anthropic lança Claude Haiku 5.5 com foco em velocidade e menor custo para tarefas de IA

Imagem para ajudar a entender a matéria

Anthropic apresenta novo modelo Claude Haiku 5.5

A Anthropic anunciou em 7 de outubro de 2026, no horário local, o lançamento do Claude Haiku 5.5, um modelo de inteligência artificial voltado para tarefas mais específicas e de execução rápida. A empresa afirmou que o modelo é o mais veloz já desenvolvido pela companhia considerando a velocidade padrão de cada modelo, embora ainda fique atrás do modo Fast do modelo Opus.

Segundo a Anthropic, o Haiku 5.5 é indicado para atividades de escopo mais limitado, enquanto tarefas complexas de programação baseadas em agentes continuam sendo direcionadas para modelos mais avançados.

Nova política de preços para solicitações longas

A empresa também anunciou mudanças na cobrança para solicitações extensas. O modelo passou a aplicar preços por faixas de uso: a geração de saída custa US$ 0,50 e US$ 2,50 conforme o segmento utilizado, enquanto a leitura de cache custa US$ 0,01 e US$ 0,05. A gravação de cache fica em US$ 0,125 e US$ 0,625.

A Anthropic informou que, considerando o tamanho das solicitações e a alteração no tokenizador, o custo de execução de cargas de trabalho pode ser cerca de 75% menor em comparação com o Haiku 4.5. O novo tokenizador faz com que a mesma frase de entrada seja processada com aproximadamente 30% mais tokens do que no modelo anterior, aumentando levemente o uso de tokens por tarefa.

O tamanho mínimo de prompt que pode utilizar cache foi reduzido de 4.096 para 512 tokens. O contexto máximo passou de 200 mil para 1 milhão de tokens, enquanto o limite máximo de saída aumentou de 64 mil para 128 mil tokens.

Modelo chega a plataformas de nuvem e APIs

O Claude Haiku 5.5 está disponível com o identificador claude-haiku-5-5 na Claude Platform e também nas plataformas Amazon Web Services, Google Cloud e Microsoft Azure.

Na Amazon Bedrock, o modelo utiliza o identificador global.anthropic.claude-haiku-5-5 e está disponível por meio do bedrock-runtime em diferentes perfis de inferência. A Anthropic informou, porém, que algumas funções anteriores foram removidas ou alteradas: recursos como expansão manual de raciocínio baseada em budget_tokens, configurações personalizadas de temperature, top_p e top_k, além de pré-preenchimento de mensagens do assistente, retornam erro no novo modelo.

Avaliações mostram desempenho abaixo do Sonnet 5.5

Nos testes divulgados pela própria Anthropic, o Haiku 5.5 apresentou avanços em relação ao Haiku 4.5 em diversas avaliações, mas ficou abaixo do Claude Sonnet 5.5 em todos os indicadores publicados. Em avaliações como GDPval-AA v2.1, AA-Briefcase v1.1 e OSWorld, o novo modelo registrou resultados superiores ao Haiku 4.5, mas inferiores ao modelo Sonnet 5.5.

No teste Humanity's Last Exam, o Haiku 5.5 alcançou 45,9% sem uso de ferramentas e 57,4% com ferramentas. O Sonnet 5.5 obteve 56,9% e 64,5%, respectivamente. Em avaliações de programação, como FrontierCode 1.1 Main, o Haiku 5.5 marcou 46,4%, enquanto o Sonnet 5.5 chegou a 52,1%.

Avaliação independente coloca modelo entre os líderes

A Artificial Analysis classificou o Claude Haiku 5.5 com 43 pontos no Intelligence Index, considerando a configuração de esforço máximo, colocando o modelo em segundo lugar entre 180 modelos avaliados. A organização mediu velocidade de saída de 240,4 tokens por segundo e custo por tarefa de US$ 0,21.

Empresas que testaram o modelo também divulgaram resultados. A Box informou melhora de desempenho em comparação com o Haiku 4.5 em condições de menor latência, enquanto a HubSpot divulgou uma média de 92,8% em três execuções de tarefas de CRM. A Asana relatou redução superior a 30% na latência e aumento de até 2,5 vezes na velocidade de raciocínio por turno de agente.

Segurança e limitações do novo modelo

A Anthropic afirmou que as medidas de proteção contra cibersegurança no Haiku 5.5 são mais rígidas do que no Haiku 4.5, embora menos restritivas que em outros modelos recentes da empresa. A companhia informou que testes de invasão continuam bloqueados.

Segundo informações divulgadas pelo Unite.AI a partir do sistema de avaliação de segurança do modelo, o Haiku 5.5 apresentou diferenças de comportamento em situações ambíguas, incluindo maior frequência de auxílio em pedidos relacionados à redação de cartas de suicídio em comparação com o Haiku 4.5. A auditoria de comportamento da Anthropic também apontou maior número de recusas consideradas excessivas em relação a outros modelos.

Source: Original Korean article - Trendy News Korea

Comentários