A Anthropic apresentou o Claude Haiku 5.5, sua nova aposta para cargas de trabalho em grande volume, e o recado é duplo: o preço por token despencou, mas o modelo consome bem mais tokens para entregar a mesma tarefa. Para quem roda tarefas simples em escala, a fatura final pode não cair tanto quanto o desconto anunciado sugere.
Sumário
Preço agressivo, mas dividido em duas faixas
O Haiku 5.5 estreia com uma tabela de preços em duas camadas. Para prompts de até 100 mil tokens, o custo é de US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. Acima dessa marca, os valores sobem para US$ 0,50 e US$ 2,50, respectivamente — cinco vezes mais.
Na prática, isso significa uma redução de cerca de 90% em relação ao Haiku 4.5 nos pedidos curtos, que representam aproximadamente 90% das chamadas ao modelo anterior. Para prompts longos, o corte fica em 50%. A Anthropic estima que, na média, o Haiku 5.5 custe 75% menos para rodar do que o antecessor.
Leituras em cache custam US$ 0,01 por milhão de tokens e gravações US$ 0,125, na faixa mais barata. O modelo fica disponível pelo ID claude-haiku-5-5 na API da Anthropic.
Mais tokens por tarefa: onde o desconto encolhe
O detalhe que muda a conta é o consumo. Testes independentes da Artificial Analysis compararam o Haiku 5.5 ao GPT-6 Luna, da OpenAI, que tem o mesmo preço por token na faixa básica. Em tarefas de benchmark, o Haiku 5.5 gerou 162 mil tokens de saída contra 50 mil do Luna, e 129 mil tokens de raciocínio contra 39 mil.
O resultado é que o custo médio por tarefa do Haiku 5.5 ficou em US$ 0,21, três vezes os US$ 0,07 do concorrente — apesar do preço idêntico por token. O modelo é mais rápido na geração (243 tokens por segundo contra 128), mas, por gastar mais tokens, leva mais tempo para concluir a tarefa média: 427 segundos contra 390.
Parte desse aumento vem do novo tokenizador, compartilhado com o Sonnet 5.5 e o Opus 5.5, que conta o mesmo texto como um pouco mais tokens que a versão anterior. Há ainda o parâmetro effort, que varia de baixo a máximo e começa no padrão “médio” — quanto mais esforço, mais tokens de raciocínio, cobrados como saída.
Para quem vale a pena
O Haiku 5.5 é o modelo mais rápido e barato da família Claude 5.5 e se posiciona bem em tarefas de alto volume e baixa complexidade: resumo, classificação, consultas a banco de dados e compactação de contexto. Para esse tipo de trabalho, tentar o modelo barato primeiro custa pouco e libera os modelos maiores para o que realmente exige mais raciocínio.
A própria Anthropic, porém, recomenda o Sonnet 5.5 e o Opus 5.5 para programação exigente. A lição é simples: com o Haiku 5.5, compare o custo por tarefa resolvida — e não por token — antes de migrar. Detalhes do lançamento estão na página oficial do Claude Haiku 5.5.










