Seu Hub de Inteligência Artificial

Seu Hub de IA

Banner Completo Noticias
Claude Haiku 5.5 - imagem oficial

Claude Haiku 5.5 chega 75% mais barato e mais rápido que o anterior

O Claude Haiku 5.5 é o modelo mais rápido da Anthropic. Entenda para que ele serve, quando o Sonnet e o Opus ainda são melhores e quanto você economiza.

O Claude Haiku 5.5 é o novo modelo pequeno da Anthropic, criado para tarefas que se repetem milhares de vezes e precisam sair baratas. Em média, ele custa cerca de 75% menos para rodar do que o Haiku 4.5. Segundo a própria empresa, também é o modelo mais rápido que ela já colocou no ar.

Um modelo pensado para volume, não para os problemas mais difíceis

Dentro da linha de modelos da Anthropic, o Haiku é o pequeno, abaixo do Sonnet e do Opus. A nova versão foi desenhada, nas palavras da empresa, para “tarefas de alto volume e sensíveis a custo”. Pense em resumir documentos, classificar pedidos, consultar bancos de dados ou fazer compactação de contexto, que é quando a IA condensa uma conversa longa para não perder o fio sem gastar memória à toa.

Outro uso apontado é o de subagente, um assistente auxiliar que executa pedaços menores de um trabalho enquanto um modelo maior coordena o todo. Na programação, a Anthropic diz que o Haiku 5.5 combina bem com o Opus 5.5 e o Sonnet 5.5 nesse papel. Como é rápido, ele também se encaixa em atendimento ao cliente ao vivo e em browser use, quando a IA navega sozinha por sites.

A velocidade tem uma ressalva oficial: o novo modelo é o mais rápido da casa na velocidade padrão de cada um, mas os modelos Opus no chamado Fast Mode continuam à frente. Há ainda uma novidade inédita para a linha: o ajuste de esforço, com cinco níveis (Low, Med, High, Xhigh e Max). Funciona como o câmbio de um carro, em que o usuário escolhe entre economizar combustível ou ganhar potência, ou seja, otimizar para custo ou para inteligência.

Nos testes divulgados pela empresa, o salto em relação à versão anterior é grande. No OSWorld 2.1, que mede a capacidade de operar um computador de verdade em tarefas longas, o modelo marcou 72,4%, contra 15,7% do Haiku 4.5. No Humanity’s Last Exam, uma prova de raciocínio em nível de especialista em várias áreas, foram 45,9% sem ferramentas, contra 10,2% do antecessor.

  • Preço por milhão de tokens (tokens são os pedacinhos de texto que a IA processa) em prompts de até 100 mil tokens: US$ 0,10 na entrada e US$ 0,50 na saída, contra US$ 1,00 e US$ 5,00 do Haiku 4.5.
  • Na tabela da Anthropic, o Haiku 5.5 supera o GPT-6 Luna, da OpenAI, em todos os testes com dados para os dois, como o FrontierCode 1.1 (46,4% contra 42,4%).
  • Para quem roda grandes volumes, a conta cai muito: o modelo sai 90% mais barato que o anterior em pedidos de até 100 mil tokens e 50% mais barato acima disso.
  • A economia média, de cerca de 75%, considera que parte dos pedidos fica na faixa acima de 100 mil tokens, com desconto menor, e que o novo tokenizador, a peça que quebra o texto em tokens, gasta um pouco mais de tokens por tarefa.

Onde o Claude Haiku 5.5 brilha e onde ele não é a melhor escolha

A Anthropic é direta sobre os limites. Para tarefas complexas de programação agêntica, em que a IA escreve e executa código sozinha por várias etapas, o Sonnet 5.5 e o Opus 5.5 “continuam sendo as melhores opções”. A diferença aparece no Terminal-Bench 4.0, teste de tarefas profissionais em linha de comando: 39,2% para o Haiku contra 70,6% do Sonnet. Em contrapartida, o modelo leve é indicado para trabalhos de escopo restrito que antes ficariam caros demais com versões anteriores do Claude.

Empresas que testaram a novidade relatam ganhos práticos. A Asana viu queda de mais de 30% na latência para concluir tarefas em seu agente AI Teammates, além de inferência até 2,5 vezes mais rápida por turno. A HubSpot registrou 92,8% em portais simulados de CRM, a melhor nota que já viu nessa bateria. A Box mediu 11 pontos acima do Haiku 4.5 com cerca de metade da latência. Já a Rogo descreve o uso típico: enquanto um modelo maior monta uma apresentação, um subagente Haiku busca num relatório financeiro a linha de receita necessária.

Para o usuário brasileiro, sobretudo desenvolvedores e empresas que cobram em reais e pagam em dólar, o corte de preço pesa no bolso. Dessa forma, um chatbot de atendimento ou um sistema que resume e classifica milhares de mensagens por dia pode ficar bem mais barato de manter. O modelo já está disponível na Claude Platform, a plataforma de API da Anthropic, e também na Amazon Web Services, no Google Cloud e no Microsoft Azure, com o identificador claude-haiku-5-5.

Junto com o lançamento vieram outras mudanças. A leitura de cache do Sonnet 5.5, que reaproveita trechos já processados como quem consulta anotações em vez de reler o livro, caiu de US$ 0,20 para US$ 0,10 por milhão de tokens, o que reduz em cerca de 20% o custo da maioria das tarefas agênticas desse modelo. Assinantes Max e Team passam a receber créditos mensais de API: US$ 100 no Max 5x, US$ 200 no Max 20x e até US$ 500 no Team, divididos entre a equipe, para experimentar a construção de ferramentas e agentes na Claude Platform. Os SDKs de Python e TypeScript também ganharam suporte beta a uso de computador e de navegador.

Na segurança, a empresa afirma que o novo Haiku teve melhoras importantes em quase todas as avaliações de alinhamento, com muito menos casos de comportamento desalinhado e menor disposição de colaborar com uso indevido. As travas de cibersegurança permitem mais tarefas defensivas do que as do Sonnet 5.5, mas seguem bloqueando testes de invasão e técnicas mais usadas por atacantes.

Os números, teste a teste

A página oficial compara o Haiku 5.5 com o Haiku 4.5, com o GPT-6 Luna, da OpenAI, e, como referência, com o Sonnet 5.5. A tabela é publicada pela própria Anthropic. Os resultados, na ordem Haiku 5.5, Haiku 4.5, GPT-6 Luna e Sonnet 5.5:

  • GDPval-AA v2.1, trabalho de conhecimento em 44 profissões, em pontuação Elo: 1620, 735, 1437 e 1840.
  • AA-Briefcase v1.1, trabalho de conhecimento, em Elo: 1578, 614, 1336 e 1824.
  • OSWorld 2.1, subconjunto offline, uso de computador: 72,4%, 15,7%, 48,9% e 83,9%.
  • Humanity’s Last Exam sem ferramentas: 45,9%, 10,2%, sem dado e 56,9%. Com ferramentas: 57,4%, 18,7%, sem dado e 64,5%.
  • Terminal-Bench 4.0, programação em linha de comando: 39,2%, 0,0%, 16,4% e 70,6%.
  • FrontierCode 1.1 (Main), programação agêntica: 46,4%, sem dado, 42,4% e 52,1%.
  • Chartography, leitura de gráficos, sem ferramentas: 46,4%, 6,4%, 29,1% e 61,6%.

O padrão é claro: o Haiku 5.5 dá um salto enorme sobre o antecessor, supera o GPT-6 Luna em todos os testes em que há dado para os dois e fica abaixo do Sonnet 5.5, principalmente em programação agêntica.

Para quem é: desenvolvedores e empresas que processam grandes volumes de texto com tarefas bem definidas, como atendimento ao cliente ao vivo, resumos, classificação de mensagens, consultas a bancos de dados, compactação de contexto e subagentes de programação.

Para quem não é a melhor escolha: quem precisa de um modelo que conduza sozinho tarefas complexas e longas, como programação agêntica difícil, onde a própria Anthropic indica o Sonnet 5.5 ou o Opus 5.5.

Perguntas frequentes

Quanto custa usar o Claude Haiku 5.5?

O Claude Haiku 5.5 tem duas faixas de preço por milhão de tokens. Em prompts de até 100 mil tokens, a entrada custa US$ 0,10 e a saída, US$ 0,50. Acima disso, os valores sobem para US$ 0,50 e US$ 2,50. Segundo a Anthropic, a economia média em relação ao Haiku 4.5 fica em torno de 75%.

Devo usar o Haiku 5.5 ou o Sonnet 5.5 para programar?

Depende do tamanho da tarefa. A própria Anthropic recomenda o Sonnet 5.5 e o Opus 5.5 para programação agêntica complexa, em que o modelo trabalha sozinho por várias etapas. O Haiku 5.5 é mais indicado como subagente, cuidando de partes menores do código, resumos e consultas rápidas, com custo bem mais baixo.

Fonte: Anthropic

Análise Crítica

Com o Haiku 5.5, a Anthropic reforça uma divisão de trabalho que ela mesma descreve: os modelos grandes conduzem o raciocínio difícil e o pequeno cuida do volume, como subagente, resumos, classificação e atendimento ao vivo. Os créditos mensais de API para assinantes Max e Team empurram na mesma direção, aproximando quem usa o chat de quem constrói produtos em cima da API. O recado para a concorrência é direto: em uma tabela publicada pela própria Anthropic, e portanto escolhida por ela, o Haiku 5.5 supera o GPT-6 Luna, da OpenAI, em todos os testes com dado para os dois, o que aperta o argumento do modelo leve como porta de entrada de ecossistema.

Para uma startup brasileira de SaaS que vende triagem de tickets ou resumo de contratos, a decisão é concreta: refazer a conta de margem com o novo preço, testar o modelo de volume e decidir se parte do que hoje roda em modelos maiores pode migrar. O padrão é conhecido: o preço de lançamento vira referência de mercado e os concorrentes passam a ser comparados com ele. O risco para quem constrói é amarrar toda a arquitetura de subagentes a um único fornecedor. A pergunta para a Anthropic é: com um modelo pequeno tão capaz, quanto do uso que hoje roda no Sonnet vai migrar para o Haiku e reduzir a receita por cliente?

A visão do canal Invente com IA

Se você tem qualquer fluxo que resume, classifica ou responde clientes em volume, vale muito testar o Haiku 5.5 nos próximos 30 dias. Pegue uma amostra real, tipo umas centenas de tickets ou e-mails, rode no modelo que você usa hoje e no Haiku 5.5, e compare acertos e custo por mil chamadas. Se você cobra seu cliente por assinatura, essa diferença vira margem direto. E se você assina o Max ou o Team, os créditos de API que estão chegando são uma boa forma de fazer esse teste sem gastar nada a mais. Pra programação pesada, continue no Sonnet ou no Opus, como a própria Anthropic recomenda.

Compartilhe este artigo

Foto de Mariana Machado de Almeida

Mariana Machado de Almeida

Compartilhe:
0 0 votos
Classificação do artigo
Inscrever-se
Notificar de
0 Comentários
mais antigos
mais recentes Mais votado

Entre para o Grupo VIP

Esteja um passo à frente. Receba o resumo diário de IA antes de todo mundo.

TV INVENTE

Banner Laterial Noticias

Bem-vindo ao Invente com IA

ou

Ao se cadastrar, você concorda com os [Termos de Serviço] e a [Política de Privacidade].