Claude Haiku 5.5: o modelo pequeno que fecha a família 5.5

O acontecimento
Em 7 de outubro de 2026 a Anthropic lançou o Claude Haiku 5.5 (claude-haiku-5-5), terceiro modelo da família Claude 5.5, depois de Opus 5.5 e Sonnet 5.5. É o modelo pequeno para trabalho de alto volume: resumos, compactação, consultas a banco, classificação e subagents em tarefas de código. A Anthropic diz que é o seu modelo mais rápido na velocidade padrão.
Preço para prompts de até 100 mil tokens: US$0,10 / US$0,50 por milhão (entrada/saída), cache reads a US$0,01. Acima de 100 mil: US$0,50 / US$2,50. A Anthropic estima custo médio cerca de 75% menor que o do Haiku 4.5, já contando o tokenizer novo (cerca de 30% mais tokens para o mesmo texto). Contexto de 1M, saída de até 128k, adaptive thinking e, pela primeira vez num Haiku, effort ajustável. Terminal-Bench 4.0: 39,2% (Haiku 4.5: 0,0%). OSWorld 2.1 offline: 72,4% (Haiku 4.5: 15,7%).
No mesmo anúncio: cache reads do Sonnet 5.5 caem de US$0,20 para US$0,10 (cerca de 20% mais barato na maioria das tarefas agentic), crédito mensal de API para Max e Team e computer use e browser use em beta nos SDKs Python e TypeScript. Disponível em Claude Platform, Amazon Bedrock, Google Cloud e Microsoft Azure.
Por que importa
Fecha a família 5.5 (Opus na edição 04, Sonnet na edição 05). Em frotas de agents, o modelo pequeno é o que mais roda: compaction, roteamento, extração e subagents. Um Haiku com computer use em 72,4% e custo de entrada a US$0,10 muda a conta de quais etapas precisam de um modelo maior.
Aplicabilidade prática
- Recalcule o custo por tarefa com o tokenizer novo; não compare só o preço de lista.
- Revise clients antes de trocar o model ID:
budget_tokensmanual, sampling fora do padrão e prefill passam a dar erro. - Computer use exige
computer_toolset_20260801no Claude API e no Google Cloud. - Respostas podem começar com blocos de thinking: selecione blocos por
type, não por posição. - Trate
stop_reason: "refusal"dos classifiers de segurança no client. - Se você usa Sonnet 5.5 com muito cache, refaça a conta com o cache read a US$0,10.
Limitações e incertezas
Não executei o modelo. Benchmarks e estimativas de custo são os reportados pela Anthropic. A própria empresa indica Sonnet e Opus para código agentic complexo. Cyber safeguards do Haiku 5.5 são diferentes dos do Sonnet 5.5 (permitem mais tarefas defensivas, mas bloqueiam pentest).
Fontes originais
- Anthropic, Introducing Claude Haiku 5.5 (7 out 2026): https://www.anthropic.com/claude-haiku-5-5
- Claude Platform, What's new in Claude Haiku 5.5: https://platform.claude.com/docs/en/models/haiku-5-5/whats-new-haiku-5-5
- AWS Machine Learning Blog, Introducing Claude Haiku 5.5 on AWS: https://aws.amazon.com/blogs/machine-learning/introducing-claude-haiku-5-5-on-aws/