← Portal SSTFLIX💰 Lançamento

Claude Opus 5.5 chega com corte de preço de tokens em até 60%

A nova versão promete mais eficiência e impacta diretamente o bolso de quem usa a IA. É hora de otimizar.

Redação SSTFLIXPortal SSTFLIX.AI
3 min de leituraRedigida por IA · revisão editorial
Claude Opus 5.5 chega com corte de preço de tokens em até 60%

A Anthropic lançou o Claude Opus 5.5, uma atualização do seu modelo de inteligência artificial. A principal novidade é a redução nos preços dos tokens de entrada e saída, além de um corte significativo no custo de leitura de dados em cache. Na prática, uma sessão que antes custava US$ 3,50 pode sair por US$ 2,40. Isso representa uma economia de cerca de 31% para os usuários.

Essa mudança é um alívio para quem trabalha com a ferramenta. Profissionais, pequenas empresas e freelancers que dependem da IA para tarefas longas e complexas verão o orçamento render mais. A promessa é de maior eficiência e, consequentemente, mais uso do modelo com o mesmo investimento. Para quem atua de forma independente, significa mais competitividade e margem de lucro.

Como a nova precificação funciona

O preço do token de entrada caiu de US$ 5 para US$ 4 por milhão de tokens. Já o custo dos tokens de saída foi de US$ 25 para US$ 20. A maior diferença está na leitura de cache, que despencou 60%, de US$ 0,50 para US$ 0,20 por milhão de tokens. Essa redução beneficia principalmente sessões que reutilizam muitas informações, como na análise de grandes bases de dados ou códigos.

Dicas para economizar ainda mais

  • Escolha o nível de esforço adequado para cada tarefa.
  • Use cada modelo (Opus, Sonnet, Haiku) para uma função específica.
  • Aproveite o sistema de cache para dados repetidos.
  • Faça auditoria constante dos prompts para otimização.
  • Acompanhe o uso de tokens para identificar gargalos.

A Anthropic sugere ajustar o 'nível de esforço' do modelo. Para tarefas simples, um nível baixo evita gastos desnecessários. Já em problemas complexos, vale a pena investir em níveis mais altos. Além disso, usar modelos como Sonnet e Haiku para tarefas secundárias e deixar o Opus 5.5 para o trabalho principal também ajuda a otimizar o consumo de tokens.

O cache é crucial em sessões longas, onde a leitura de dados armazenados custa uma fração do token de entrada. Ele dura uma hora nos planos pagos e cinco minutos na API. Para aproveitar, evite alterações constantes nas definições de ferramentas ou no prompt do sistema. Mudar o nível de esforço também invalida o cache, forçando uma regravação mais cara.

#anthropic#claude#ia#custos#produtividade

Continue lendo