Novo modelo da Anthropic busca tornar tarefas repetitivas mais baratas. O anúncio também reduz o custo de cache do Sonnet 5.5 e cria créditos de API para assinantes Max e Team.
A Anthropic lançou nesta quarta-feira, 7 de outubro, o Claude Haiku 5.5, seu novo modelo voltado a tarefas rápidas e de alto volume. Para prompts de até 100 mil tokens, o preço de entrada e saída caiu 90% em relação ao Haiku 4.5. Considerando diferentes tamanhos de requisição e o consumo de tokens, a empresa estima uma economia média de aproximadamente 75% por trabalho realizado. [1]
A proposta é ampliar o uso de IA em atividades que se repetem milhares de vezes: resumir documentos, classificar solicitações, extrair informações e executar pequenas etapas dentro de um projeto maior. Sonnet 5.5 e Opus 5.5 continuam sendo as opções recomendadas pela Anthropic para programação complexa. [1]
O que muda, em poucos pontos
- Preço menor: US$ 0,10 por milhão de tokens de entrada e US$ 0,50 de saída para prompts de até 100 mil tokens. [1]
- Esforço ajustável: pela primeira vez na linha Haiku, é possível regular o esforço de raciocínio para equilibrar qualidade, velocidade e custo. [1]
- Mais contexto: a documentação informa uma janela de 1 milhão de tokens e até 128 mil tokens de saída. [2]
- Papel de subagente: Haiku pode receber tarefas delimitadas de um modelo maior, como buscar um dado ou resumir um documento. [1]
- Acesso ampliado: o anúncio inclui a plataforma da Anthropic, AWS, Google Cloud e Microsoft Azure. [1]
Tokens são as unidades em que o modelo divide textos e outros conteúdos para processá-los e contabilizar o uso. Um milhão de tokens não corresponde a uma quantidade fixa de palavras.
Por que o preço caiu 90%, mas a economia anunciada é de 75%?
Os dois números medem coisas diferentes. O corte de 90% se refere à tabela de preços para requisições de até 100 mil tokens. Acima desse limite, a redução por token é de 50%. [1]
Preço em dólares por 1 milhão de tokens na tabela de lançamento:
| Tipo de consumo | Haiku 5.5: prompt até 100 mil | Haiku 5.5: prompt acima de 100 mil | Haiku 4.5 |
|---|---|---|---|
| Entrada | US$ 0,10 | US$ 0,50 | US$ 1,00 |
| Saída | US$ 0,50 | US$ 2,50 | US$ 5,00 |
| Leitura de cache | US$ 0,01 | US$ 0,05 | US$ 0,10 |
| Escrita de cache, 5 minutos | US$ 0,125 | US$ 0,625 | US$ 1,25 |
Fonte: Anthropic. Valores da Claude Platform; condições de outros provedores devem ser verificadas separadamente. [1]
A economia média de 75% também considera mudanças na quantidade de tokens necessária para realizar um trabalho. O novo tokenizador pode representar o mesmo texto com mais unidades. A documentação técnica quantifica o aumento de tokens de entrada em aproximadamente 30%, dependendo do conteúdo. [2]
Um exemplo ajuda: se um lote consumir 1 milhão de tokens de entrada e 200 mil de saída, distribuídos em requisições dentro da faixa mais barata, a conta básica será de US$ 0,20 no Haiku 5.5, contra US$ 2 no Haiku 4.5. É um cálculo com consumo idêntico, sem cache, ferramentas ou novas tentativas. Na aplicação real, esse consumo pode mudar.
O preço por token caiu. A economia de cada aplicação dependerá de quanto o modelo precisa trabalhar para entregar uma resposta útil.
Benchmarks mostram avanço, com limites claros
Na comparação divulgada pela Anthropic, o Haiku 5.5 supera o Haiku 4.5 em trabalho profissional, uso de computador, raciocínio e programação. Também fica à frente do GPT-6 Luna nas avaliações comparáveis apresentadas. O Sonnet 5.5 permanece acima do Haiku em todas as linhas da tabela. [1]
| Avaliação | O que testa | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|---|
| GDPval-AA v2.1 | Trabalho profissional, Elo | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | Trabalho profissional, Elo | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, subconjunto offline | Operação de computador, crédito parcial | 72,4% | 15,7% | 48,9% | 83,9% |
| Humanity’s Last Exam, sem ferramentas | Conhecimento e raciocínio acadêmico | 45,9% | 10,2% | Não informado | 56,9% |
| Humanity’s Last Exam, com ferramentas | Conhecimento e raciocínio acadêmico | 57,4% | 18,7% | Não informado | 64,5% |
| Terminal-Bench 4.0 | Tarefas de programação em terminal | 39,2% | 0,0% | 16,4% | 70,6% |
| FrontierCode 1.1, Main | Programação agêntica | 46,4% | Não informado | 42,4% | 52,1%* |
| Chartography, sem ferramentas | Raciocínio visual | 46,4% | 6,4% | 29,1% | 61,6% |
Resultados reportados pela Anthropic. O Sonnet aparece com esforço Xhigh no FrontierCode. As pontuações de trabalho profissional não são percentuais. [1]
Esses números não demonstram superioridade em qualquer tarefa. São resultados de avaliações específicas, reunidos pelo fornecedor. O System Card informa que GDPval-AA e AA-Briefcase foram executados independentemente pela Artificial Analysis. Nos demais casos, a origem e as condições devem ser verificadas por avaliação. A configuração geral dos resultados do Haiku é raciocínio adaptativo com esforço máximo, salvo indicação diferente. [11]
Há uma distinção decisiva no OSWorld: 72,4% é a pontuação média com crédito parcial, não a taxa de conclusão integral. Quando o critério exige cumprir todos os pontos de verificação, o Haiku alcança 37,1%. O teste usou 82 tarefas do subconjunto offline, sem internet, em esforço máximo, com cinco tentativas independentes por tarefa. [11]
O esforço também muda os placares de trabalho profissional. No GDPval-AA, Haiku registra 1620 em Max e 1277 em Medium, o padrão da API. No AA-Briefcase, são 1578 e 1372, respectivamente. Segundo o documento, Medium consome aproximadamente um décimo dos tokens de saída de Max no primeiro teste e menos de um quarto no segundo. Comparar qualidade sem comparar esse consumo pode distorcer a decisão. [11]
No Terminal-Bench, os 39,2% do Haiku foram obtidos sem acesso à internet e com salvaguardas habilitadas, sem modelo de fallback. A avaliação do Sonnet usou fallback em requisições sinalizadas. Os sistemas de execução e as condições, portanto, também participam da comparação. [11]
Como o mercado recebeu o anúncio
A reação inicial reúne cobertura jornalística, distribuição por parceiros e avaliações de clientes. Isso permite observar interesse, mas ainda não comprova adoção consolidada.
A Reuters destacou a expansão da família Claude 5.5 com o terceiro lançamento em menos de um mês. [7] A VentureBeat enfatizou a queda de preço e a competição com o GPT-6 Luna. [8]
Entre os parceiros, a AWS publicou orientação de uso no Amazon Bedrock, com Opus planejando o trabalho e Haiku executando tarefas bem definidas. [5] O GitHub anunciou Haiku 5.5 no Copilot, com distribuição gradual para Pro, Pro+, Max, Business e Enterprise. [6]
Nos depoimentos reunidos pela Anthropic, a Asana relatou redução superior a 30% no tempo de conclusão de tarefas em seus testes. São relatos selecionados pelo fornecedor, úteis como sinais de aplicação, mas diferentes de auditorias independentes. [1]
Uma avaliação externa já aparece na Artificial Analysis. Na configuração Medium, a página consultada em 7 de outubro registra 34 pontos no Intelligence Index e aproximadamente 137 tokens de saída por segundo. A mesma página informa 12,63 segundos até o primeiro token. [9]
Essa distinção importa: gerar texto rapidamente depois que a resposta começa não significa começar a responder imediatamente. Os números são um retrato da medição consultada, não uma garantia para atendimento ao vivo ou para qualquer infraestrutura.
Onde usar e o que revisar antes de migrar
Segundo a página do produto, Haiku 5.5 pode ser selecionado no Claude.ai pelos planos Free, Pro, Max, Team e Enterprise, e também está disponível no Claude Code. Na API da Anthropic, o identificador é claude-haiku-5-5. A disponibilidade de um modelo não elimina os limites de cada plano. [3]
Para desenvolvedores, trocar apenas o nome pode ser insuficiente. O guia de migração orienta revisar a contagem de tokens, o formato de raciocínio e parâmetros antigos. O esforço padrão é Medium. A ficha do modelo especifica que os preços de escrita de cache da tabela correspondem à retenção de cinco minutos; uma hora custa US$ 0,20 ou US$ 1 por milhão de tokens, conforme a faixa do prompt. [12] Também recomenda selecionar os blocos da resposta pelo tipo, em vez de presumir que o primeiro bloco contém a resposta textual. [4]
O suporte a tarefas de navegador e computador é acompanhado de atualizações dos SDKs Python e TypeScript em beta. Isso cria uma possibilidade de integração, mas não equivale a um agente pronto que já tenha acesso aos sistemas da empresa. [1]
Sonnet mais barato e créditos para construir aplicações
O lançamento traz uma redução adicional: a leitura de cache do Sonnet 5.5 cai de US$ 0,20 para US$ 0,10 por milhão de tokens. Cache permite reaproveitar contexto já processado, como instruções e documentos repetidos. A Anthropic estima aproximadamente 20% de economia na maioria dos trabalhos agênticos, conforme a participação desse reaproveitamento no consumo. [1]
Os créditos mensais de API anunciados para implantação nesta semana têm regras próprias: [10]
| Plano | Crédito mensal |
|---|---|
| Max 5x | US$ 100 |
| Max 20x | US$ 200 |
| Team | US$ 20 por assento Standard e US$ 100 por Premium, até US$ 500 compartilhados |
É necessário vincular uma organização do Claude Console. Os créditos vencem ao final do ciclo e não acumulam. Free, Pro e Enterprise não são elegíveis. Eles também não cobrem Claude Code, consumo extra nos aplicativos ou uso por AWS, Google Cloud e Microsoft Foundry. [10]
Segurança e consequência prática
A Anthropic afirma ter melhorado os resultados de alinhamento, com menos comportamentos desalinhados e menor cooperação com usos indevidos. Também informa salvaguardas de cibersegurança mais restritivas que as do Haiku 4.5, incluindo bloqueios a testes de penetração nas condições padrão. São declarações do fornecedor sobre suas avaliações e políticas. [1]
Na leitura editorial da MnzAI Labs, a mudança mais relevante está na divisão do trabalho dentro dos Fluxos Agênticos. Um modelo maior pode interpretar uma solicitação complexa, enquanto Haiku resume documentos, classifica itens ou busca dados para sustentar a resposta.
O critério para decidir será o custo por tarefa concluída corretamente, incluindo novas tentativas e revisão. Se a redução de preço vier acompanhada de qualidade suficiente no processo real, atividades antes caras demais para automatizar podem se tornar viáveis.
Fontes
Todas consultadas em 7 de outubro de 2026. Links em inglês.
- Anthropic: anúncio de Claude Haiku 5.5, preços, benchmarks e notas.
- Claude Platform: novidades e mudanças técnicas.
- Anthropic: página do produto Haiku e disponibilidade.
- Claude Platform: guia de migração.
- AWS: lançamento no Amazon Bedrock e orientações de uso.
- GitHub: Haiku 5.5 no Copilot.
- Reuters: expansão da família Claude 5.5.
- VentureBeat: cobertura do lançamento e competição por preço.
- Artificial Analysis: avaliação do Haiku 5.5 em Medium.
- Claude Platform: valores, elegibilidade e regras dos créditos de API.
- Anthropic: System Card de Haiku 5.5, seções 8.1, 8.4, 8.9.3, 8.10.2 e 8.10.3.
- Claude Platform: ficha oficial, esforço padrão e preços de cache.
