Anthropic lança Claude Haiku 5.5 com preço agressivo, mas modelo consome bem mais tokens

O Claude Haiku 5.5 chega custando até 90% menos que o Haiku 4.5 em prompts curtos, mas usa cerca de 3,5 vezes mais tokens que o GPT-6 Luna para concluir as mesmas tarefas.

Publicado

A Anthropic apresentou o Claude Haiku 5.5, sua nova aposta para cargas de trabalho em grande volume, e o recado é duplo: o preço por token despencou, mas o modelo consome bem mais tokens para entregar a mesma tarefa. Para quem roda tarefas simples em escala, a fatura final pode não cair tanto quanto o desconto anunciado sugere.

Preço agressivo, mas dividido em duas faixas

O Haiku 5.5 estreia com uma tabela de preços em duas camadas. Para prompts de até 100 mil tokens, o custo é de US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. Acima dessa marca, os valores sobem para US$ 0,50 e US$ 2,50, respectivamente — cinco vezes mais.

Na prática, isso significa uma redução de cerca de 90% em relação ao Haiku 4.5 nos pedidos curtos, que representam aproximadamente 90% das chamadas ao modelo anterior. Para prompts longos, o corte fica em 50%. A Anthropic estima que, na média, o Haiku 5.5 custe 75% menos para rodar do que o antecessor.

Leituras em cache custam US$ 0,01 por milhão de tokens e gravações US$ 0,125, na faixa mais barata. O modelo fica disponível pelo ID claude-haiku-5-5 na API da Anthropic.

Mais tokens por tarefa: onde o desconto encolhe

O detalhe que muda a conta é o consumo. Testes independentes da Artificial Analysis compararam o Haiku 5.5 ao GPT-6 Luna, da OpenAI, que tem o mesmo preço por token na faixa básica. Em tarefas de benchmark, o Haiku 5.5 gerou 162 mil tokens de saída contra 50 mil do Luna, e 129 mil tokens de raciocínio contra 39 mil.

O resultado é que o custo médio por tarefa do Haiku 5.5 ficou em US$ 0,21, três vezes os US$ 0,07 do concorrente — apesar do preço idêntico por token. O modelo é mais rápido na geração (243 tokens por segundo contra 128), mas, por gastar mais tokens, leva mais tempo para concluir a tarefa média: 427 segundos contra 390.

Parte desse aumento vem do novo tokenizador, compartilhado com o Sonnet 5.5 e o Opus 5.5, que conta o mesmo texto como um pouco mais tokens que a versão anterior. Há ainda o parâmetro effort, que varia de baixo a máximo e começa no padrão “médio” — quanto mais esforço, mais tokens de raciocínio, cobrados como saída.

Para quem vale a pena

O Haiku 5.5 é o modelo mais rápido e barato da família Claude 5.5 e se posiciona bem em tarefas de alto volume e baixa complexidade: resumo, classificação, consultas a banco de dados e compactação de contexto. Para esse tipo de trabalho, tentar o modelo barato primeiro custa pouco e libera os modelos maiores para o que realmente exige mais raciocínio.

A própria Anthropic, porém, recomenda o Sonnet 5.5 e o Opus 5.5 para programação exigente. A lição é simples: com o Haiku 5.5, compare o custo por tarefa resolvida — e não por token — antes de migrar. Detalhes do lançamento estão na página oficial do Claude Haiku 5.5.

Anthropic, Claude, GPT-6, Inteligência Artificial, OpenAI

Apoio

Participe da campanha!

Cafézinho

Quer me pagar um café? Pode usar a chave PIX abaixo

Chave PIX e-mail

[email protected]

Vídeos

Assista e se inscreva em nosso canal!

NEWSLETTER

Cadastre-se gratuitamente e fique por dentro de todas as novidades do blog, como dicas e tutoriais.

Não enviamos spams, fique tranquilo

Deixe um comentário

Este site utiliza o Akismet para reduzir spam. Saiba como seus dados em comentários são processados.