A Anthropic lançou o Claude Sonnet 5.5 a 28 de setembro, o segundo da série Claude 5.5, enquanto a empresa se prepara para um IPO. Isto marca uma mudança importante nos critérios utilizados para avaliar as tecnologias de IA: embora o desempenho bruto nos benchmarks continue a ser uma consideração fundamental, as empresas estão agora também preocupadas com o custo para alcançar resultados com um modelo específico.
A Anthropic afirma que o Sonnet 5.5 opera mais de 30% mais rápido em comparação com o Sonnet 5, e que a sua aplicação pode custar até 30% menos para a maioria das tarefas, mesmo que os preços dos tokens permaneçam inalterados. De acordo com a página de lançamento da Anthropic, esta redução de custos é conseguida através da diminuição da utilização de tokens para realizar a mesma tarefa.
O Sonnet 5.5 tem um preço de 2 dólares por milhão de tokens de entrada, 10 dólares por tokens de saída utilizados e 0,20 dólares por tokens de leitura de cache utilizados. O Opus 5.5, especializado em raciocínio complexo e operações de julgamento, tem preços de 4 e 20 dólares para tokens de entrada e saída, respetivamente. O Sonnet está orientado para tarefas simples como codificação, geração de documentos e folhas de cálculo.
Isto coloca a eficiência no centro das discussões. Para muitas tarefas, as empresas não têm de optar pelo modelo com melhor desempenho. Se um modelo de baixo custo conseguir executar a tarefa desejada de forma consistente, isso pode ser mais significativo do que obter uma pontuação ligeiramente mais elevada num benchmark. Este aspeto é especialmente importante para a Anthropic, uma vez que, segundo a Reuters , cerca de 80% da receita da empresa provém de clientes empresariais.
Segundo a Anthropic, o Sonnet 5.5 obteve 70,6% no Terminal-Bench 4.0, em comparação com os 10,3% do Sonnet 5. Mas a tabela de classificação da Artificial Analysis mostra porque é que as pontuações de benchmark representam apenas parte da história.
O Sonnet 5.5, com o máximo esforço, atinge uma pontuação de 56 na escala de inteligência, com um custo estimado de 7,60 dólares por tarefa individual. O GPT-6 Sol consegue 48 pontos a 1,06 dólares por tarefa, enquanto o MiMo-V2.6-Pro da Xiaomi atinge uma pontuação de 46 por um custo irrisório de apenas 0,13 dólares. Estas diferenças de custos motivam as empresas a optar por múltiplas abordagens: é possível atribuir tarefas mais complexas a sistemas de ponta, enquanto as tarefas rotineiras podem ser executadas por sistemas mais baratos.

Esta mudança insere-se numa tendência muito maior observada ao longo do tempo. De acordo com o relatório da Epoch AI de 22 de setembro, os custos para um nível específico de desempenho da IA diminuíram aproximadamente 47% a cada trimestre a partir de 2023, uma redução anual de cerca de 13 vezes.
Um Cryptopolitan relatório publicado a 29 de setembro refere que os compradores empresariais estão cada vez mais a optar pelo modelo mais acessível que execute as tarefas necessárias, enquanto os preços baixos também permitem às empresas justificar a utilização de múltiplos modelos.
No entanto, custos mais baixos não garantem menores despesas com IA. O relatório da Gartner de 17 de agosto, intitulado "Gartner prevê que os custos de inferência de IA por fluxo de trabalho agente aumentarão mais de cinco vezes até 2028", aborda o "paradoxo da inferência". A queda do preço dos tokens estimula fluxos de trabalho mais complexos, o que resulta num aumento da utilização total de tokens.
“Os líderes de produto não podem confiar numa economia de tokens mais eficiente para racionalizar os custos de IA.”
— Will Sommer, Analista Diretor Sénior da Gartner, no relatório da Gartner de 17 de agosto de 2026.
De acordo com o Relatório Global de Difusão da IA publicado pela Microsoft, os modelos de baixo custo e com código aberto têm o potencial de aumentar a acessibilidade, particularmente no Sul Global. Embora seja verdade que os custos mais baixos dos modelos melhoram a acessibilidade, a infraestrutura, a conectividade e as competências são fatores decisivos para a utilização de modelos de IA mais baratos.
Para os compradores empresariais, o Sonnet 5.5 mostra para onde caminha o mercado: o melhor modelo não é necessariamente o mais potente, mas sim aquele que consegue realizar bem o trabalho a um custo razoável. O Haiku 5.5, previsto para as próximas semanas, poderá impulsionar ainda mais esta mudança, tornando o trabalho de IA em grande volume mais barato e dificultando as empresas de justificar o pagamento de preços mais elevados por tarefas rotineiras.
As mentes mais brilhantes do mundo das criptomoedas já leem nossa newsletter. Quer participar? Junte-se a elas.