O Claude Haiku 5.5 é o novo modelo pequeno da Anthropic, criado para tarefas que se repetem milhares de vezes e precisam sair baratas. Em média, ele custa cerca de 75% menos para rodar do que o Haiku 4.5. Segundo a própria empresa, também é o modelo mais rápido que ela já colocou no ar.
Um modelo pensado para volume, não para os problemas mais difíceis
Dentro da linha de modelos da Anthropic, o Haiku é o pequeno, abaixo do Sonnet e do Opus. A nova versão foi desenhada, nas palavras da empresa, para “tarefas de alto volume e sensíveis a custo”. Pense em resumir documentos, classificar pedidos, consultar bancos de dados ou fazer compactação de contexto, que é quando a IA condensa uma conversa longa para não perder o fio sem gastar memória à toa.
Outro uso apontado é o de subagente, um assistente auxiliar que executa pedaços menores de um trabalho enquanto um modelo maior coordena o todo. Na programação, a Anthropic diz que o Haiku 5.5 combina bem com o Opus 5.5 e o Sonnet 5.5 nesse papel. Como é rápido, ele também se encaixa em atendimento ao cliente ao vivo e em browser use, quando a IA navega sozinha por sites.
A velocidade tem uma ressalva oficial: o novo modelo é o mais rápido da casa na velocidade padrão de cada um, mas os modelos Opus no chamado Fast Mode continuam à frente. Há ainda uma novidade inédita para a linha: o ajuste de esforço, com cinco níveis (Low, Med, High, Xhigh e Max). Funciona como o câmbio de um carro, em que o usuário escolhe entre economizar combustível ou ganhar potência, ou seja, otimizar para custo ou para inteligência.
Nos testes divulgados pela empresa, o salto em relação à versão anterior é grande. No OSWorld 2.1, que mede a capacidade de operar um computador de verdade em tarefas longas, o modelo marcou 72,4%, contra 15,7% do Haiku 4.5. No Humanity’s Last Exam, uma prova de raciocínio em nível de especialista em várias áreas, foram 45,9% sem ferramentas, contra 10,2% do antecessor.
- Preço por milhão de tokens (tokens são os pedacinhos de texto que a IA processa) em prompts de até 100 mil tokens: US$ 0,10 na entrada e US$ 0,50 na saída, contra US$ 1,00 e US$ 5,00 do Haiku 4.5.
- Na tabela da Anthropic, o Haiku 5.5 supera o GPT-6 Luna, da OpenAI, em todos os testes com dados para os dois, como o FrontierCode 1.1 (46,4% contra 42,4%).
- Para quem roda grandes volumes, a conta cai muito: o modelo sai 90% mais barato que o anterior em pedidos de até 100 mil tokens e 50% mais barato acima disso.
- A economia média, de cerca de 75%, considera que parte dos pedidos fica na faixa acima de 100 mil tokens, com desconto menor, e que o novo tokenizador, a peça que quebra o texto em tokens, gasta um pouco mais de tokens por tarefa.
Onde o Claude Haiku 5.5 brilha e onde ele não é a melhor escolha
A Anthropic é direta sobre os limites. Para tarefas complexas de programação agêntica, em que a IA escreve e executa código sozinha por várias etapas, o Sonnet 5.5 e o Opus 5.5 “continuam sendo as melhores opções”. A diferença aparece no Terminal-Bench 4.0, teste de tarefas profissionais em linha de comando: 39,2% para o Haiku contra 70,6% do Sonnet. Em contrapartida, o modelo leve é indicado para trabalhos de escopo restrito que antes ficariam caros demais com versões anteriores do Claude.
Empresas que testaram a novidade relatam ganhos práticos. A Asana viu queda de mais de 30% na latência para concluir tarefas em seu agente AI Teammates, além de inferência até 2,5 vezes mais rápida por turno. A HubSpot registrou 92,8% em portais simulados de CRM, a melhor nota que já viu nessa bateria. A Box mediu 11 pontos acima do Haiku 4.5 com cerca de metade da latência. Já a Rogo descreve o uso típico: enquanto um modelo maior monta uma apresentação, um subagente Haiku busca num relatório financeiro a linha de receita necessária.
Para o usuário brasileiro, sobretudo desenvolvedores e empresas que cobram em reais e pagam em dólar, o corte de preço pesa no bolso. Dessa forma, um chatbot de atendimento ou um sistema que resume e classifica milhares de mensagens por dia pode ficar bem mais barato de manter. O modelo já está disponível na Claude Platform, a plataforma de API da Anthropic, e também na Amazon Web Services, no Google Cloud e no Microsoft Azure, com o identificador claude-haiku-5-5.
Junto com o lançamento vieram outras mudanças. A leitura de cache do Sonnet 5.5, que reaproveita trechos já processados como quem consulta anotações em vez de reler o livro, caiu de US$ 0,20 para US$ 0,10 por milhão de tokens, o que reduz em cerca de 20% o custo da maioria das tarefas agênticas desse modelo. Assinantes Max e Team passam a receber créditos mensais de API: US$ 100 no Max 5x, US$ 200 no Max 20x e até US$ 500 no Team, divididos entre a equipe, para experimentar a construção de ferramentas e agentes na Claude Platform. Os SDKs de Python e TypeScript também ganharam suporte beta a uso de computador e de navegador.
Na segurança, a empresa afirma que o novo Haiku teve melhoras importantes em quase todas as avaliações de alinhamento, com muito menos casos de comportamento desalinhado e menor disposição de colaborar com uso indevido. As travas de cibersegurança permitem mais tarefas defensivas do que as do Sonnet 5.5, mas seguem bloqueando testes de invasão e técnicas mais usadas por atacantes.
Os números, teste a teste
A página oficial compara o Haiku 5.5 com o Haiku 4.5, com o GPT-6 Luna, da OpenAI, e, como referência, com o Sonnet 5.5. A tabela é publicada pela própria Anthropic. Os resultados, na ordem Haiku 5.5, Haiku 4.5, GPT-6 Luna e Sonnet 5.5:
- GDPval-AA v2.1, trabalho de conhecimento em 44 profissões, em pontuação Elo: 1620, 735, 1437 e 1840.
- AA-Briefcase v1.1, trabalho de conhecimento, em Elo: 1578, 614, 1336 e 1824.
- OSWorld 2.1, subconjunto offline, uso de computador: 72,4%, 15,7%, 48,9% e 83,9%.
- Humanity’s Last Exam sem ferramentas: 45,9%, 10,2%, sem dado e 56,9%. Com ferramentas: 57,4%, 18,7%, sem dado e 64,5%.
- Terminal-Bench 4.0, programação em linha de comando: 39,2%, 0,0%, 16,4% e 70,6%.
- FrontierCode 1.1 (Main), programação agêntica: 46,4%, sem dado, 42,4% e 52,1%.
- Chartography, leitura de gráficos, sem ferramentas: 46,4%, 6,4%, 29,1% e 61,6%.
O padrão é claro: o Haiku 5.5 dá um salto enorme sobre o antecessor, supera o GPT-6 Luna em todos os testes em que há dado para os dois e fica abaixo do Sonnet 5.5, principalmente em programação agêntica.
Para quem é: desenvolvedores e empresas que processam grandes volumes de texto com tarefas bem definidas, como atendimento ao cliente ao vivo, resumos, classificação de mensagens, consultas a bancos de dados, compactação de contexto e subagentes de programação.
Para quem não é a melhor escolha: quem precisa de um modelo que conduza sozinho tarefas complexas e longas, como programação agêntica difícil, onde a própria Anthropic indica o Sonnet 5.5 ou o Opus 5.5.
Perguntas frequentes
Quanto custa usar o Claude Haiku 5.5?
O Claude Haiku 5.5 tem duas faixas de preço por milhão de tokens. Em prompts de até 100 mil tokens, a entrada custa US$ 0,10 e a saída, US$ 0,50. Acima disso, os valores sobem para US$ 0,50 e US$ 2,50. Segundo a Anthropic, a economia média em relação ao Haiku 4.5 fica em torno de 75%.
Devo usar o Haiku 5.5 ou o Sonnet 5.5 para programar?
Depende do tamanho da tarefa. A própria Anthropic recomenda o Sonnet 5.5 e o Opus 5.5 para programação agêntica complexa, em que o modelo trabalha sozinho por várias etapas. O Haiku 5.5 é mais indicado como subagente, cuidando de partes menores do código, resumos e consultas rápidas, com custo bem mais baixo.
Fonte: Anthropic
Análise Crítica
Com o Haiku 5.5, a Anthropic reforça uma divisão de trabalho que ela mesma descreve: os modelos grandes conduzem o raciocínio difícil e o pequeno cuida do volume, como subagente, resumos, classificação e atendimento ao vivo. Os créditos mensais de API para assinantes Max e Team empurram na mesma direção, aproximando quem usa o chat de quem constrói produtos em cima da API. O recado para a concorrência é direto: em uma tabela publicada pela própria Anthropic, e portanto escolhida por ela, o Haiku 5.5 supera o GPT-6 Luna, da OpenAI, em todos os testes com dado para os dois, o que aperta o argumento do modelo leve como porta de entrada de ecossistema.
Para uma startup brasileira de SaaS que vende triagem de tickets ou resumo de contratos, a decisão é concreta: refazer a conta de margem com o novo preço, testar o modelo de volume e decidir se parte do que hoje roda em modelos maiores pode migrar. O padrão é conhecido: o preço de lançamento vira referência de mercado e os concorrentes passam a ser comparados com ele. O risco para quem constrói é amarrar toda a arquitetura de subagentes a um único fornecedor. A pergunta para a Anthropic é: com um modelo pequeno tão capaz, quanto do uso que hoje roda no Sonnet vai migrar para o Haiku e reduzir a receita por cliente?
A visão do canal Invente com IA
Se você tem qualquer fluxo que resume, classifica ou responde clientes em volume, vale muito testar o Haiku 5.5 nos próximos 30 dias. Pegue uma amostra real, tipo umas centenas de tickets ou e-mails, rode no modelo que você usa hoje e no Haiku 5.5, e compare acertos e custo por mil chamadas. Se você cobra seu cliente por assinatura, essa diferença vira margem direto. E se você assina o Max ou o Team, os créditos de API que estão chegando são uma boa forma de fazer esse teste sem gastar nada a mais. Pra programação pesada, continue no Sonnet ou no Opus, como a própria Anthropic recomenda.




