Claude Opus 5.5 chega com corte de preço de tokens em até 60%
A nova versão promete mais eficiência e impacta diretamente o bolso de quem usa a IA. É hora de otimizar.
A Anthropic lançou o Claude Opus 5.5, uma atualização do seu modelo de inteligência artificial. A principal novidade é a redução nos preços dos tokens de entrada e saída, além de um corte significativo no custo de leitura de dados em cache. Na prática, uma sessão que antes custava US$ 3,50 pode sair por US$ 2,40. Isso representa uma economia de cerca de 31% para os usuários.
Essa mudança é um alívio para quem trabalha com a ferramenta. Profissionais, pequenas empresas e freelancers que dependem da IA para tarefas longas e complexas verão o orçamento render mais. A promessa é de maior eficiência e, consequentemente, mais uso do modelo com o mesmo investimento. Para quem atua de forma independente, significa mais competitividade e margem de lucro.
Como a nova precificação funciona
O preço do token de entrada caiu de US$ 5 para US$ 4 por milhão de tokens. Já o custo dos tokens de saída foi de US$ 25 para US$ 20. A maior diferença está na leitura de cache, que despencou 60%, de US$ 0,50 para US$ 0,20 por milhão de tokens. Essa redução beneficia principalmente sessões que reutilizam muitas informações, como na análise de grandes bases de dados ou códigos.
Dicas para economizar ainda mais
- Escolha o nível de esforço adequado para cada tarefa.
- Use cada modelo (Opus, Sonnet, Haiku) para uma função específica.
- Aproveite o sistema de cache para dados repetidos.
- Faça auditoria constante dos prompts para otimização.
- Acompanhe o uso de tokens para identificar gargalos.
A Anthropic sugere ajustar o 'nível de esforço' do modelo. Para tarefas simples, um nível baixo evita gastos desnecessários. Já em problemas complexos, vale a pena investir em níveis mais altos. Além disso, usar modelos como Sonnet e Haiku para tarefas secundárias e deixar o Opus 5.5 para o trabalho principal também ajuda a otimizar o consumo de tokens.
O cache é crucial em sessões longas, onde a leitura de dados armazenados custa uma fração do token de entrada. Ele dura uma hora nos planos pagos e cinco minutos na API. Para aproveitar, evite alterações constantes nas definições de ferramentas ou no prompt do sistema. Mudar o nível de esforço também invalida o cache, forçando uma regravação mais cara.