Anthropic lança Sonnet 5.5: mesmo preço, até 30% menos por tarefa
O Sonnet 5.5 custa US$ 2/US$ 10 por milhão de tokens, metade do Opus 5.5, e fica a dois pontos dele no GDPval. A Anthropic diz que o custo por tarefa cai até 30%, o que pressiona contratos de serviços por hora.

A Anthropic lançou nesta segunda-feira (28) o Claude Sonnet 5.5 pelo mesmo preço do Sonnet 5: US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída, com leitura de cache a US$ 0,20. A mudança está no desempenho. No Terminal-Bench 4.0, teste de programação agêntica, o modelo marca 70,6%, contra 10,3% do antecessor, segundo a página de lançamento da empresa.
O dado que interessa a quem compra IA em escala é outro. A Anthropic afirma que o Sonnet 5.5 gera respostas mais de 30% mais rápido e custa até 30% menos por tarefa em seus testes, porque resolve o trabalho com menos chamadas de ferramenta e menos tokens. O preço de tabela ficou parado; o custo efetivo caiu.
Meio da linha, perto do topo
A comparação com o Opus 5.5, modelo mais caro da casa, explica o movimento. O Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de saída, o dobro do Sonnet 5.5 nas duas pontas, segundo a tabela oficial de preços. No GDPval-AA v2.1, que mede trabalho de conhecimento, o Sonnet 5.5 soma 1.844 pontos Elo, contra 1.846 do Opus 5.5 e 1.449 do Sonnet 5.
A distância não é zero em todos os testes. No OSWorld 2.1, de uso de computador, o Sonnet 5.5 fica em 80,1%, ante 81,8% do Opus 5.5. No Humanity's Last Exam com ferramentas, a diferença é maior: 64,5% contra 67,7%. Para tarefas de raciocínio longo, o modelo de topo ainda entrega algo que o intermediário não entrega, e a própria Anthropic posiciona o Sonnet 5.5 para "tarefas cotidianas bem delimitadas, correção de bugs e criação de documentos, apresentações e planilhas".
Para um CIO, a conta muda de eixo. Se um fluxo de análise documental hoje roda no Opus por falta de alternativa, o teste obrigatório passa a ser rodar o mesmo lote no Sonnet 5.5 e medir custo por tarefa concluída, não custo por token.
O que os clientes mediram
Os números de clientes publicados pela Anthropic vão na mesma direção. A Balyasny Asset Management relata desempenho superior em 2.441 tarefas de finanças com consumo de tokens caindo de 497 mil para 121 mil por resposta, uma redução de cerca de 76%. A Box diz que o modelo foi 2,4 vezes mais rápido que o Sonnet 5 em dados sensíveis de finanças e saúde. A Zendesk afirma que "os tickets foram processados 20% mais rápido".
Daniel Vogel, COO da Epic Games, disse que o Sonnet 5.5 "passou pela mesma régua de qualidade que se esperaria de um modelo de categoria superior" em uma auditoria de design de sistemas. Depoimentos de lançamento são escolhidos pelo fornecedor e medem casos favoráveis; servem como hipótese de teste, não como benchmark independente.
Salvaguardas cibernéticas herdadas do Opus
O Sonnet 5.5 chega com proteções de cibersegurança comparáveis às do Opus 5.5. Pedidos classificados como de maior risco "vão visivelmente recorrer ao Sonnet 5", segundo a Anthropic, e defensores que precisam de acesso ampliado podem se inscrever no Cyber Verification Program. Para equipes de segurança ofensiva e red team, isso significa que parte do trabalho vai migrar, de forma visível, para o modelo anterior, e o piloto precisa medir essa taxa de fallback antes de qualquer migração.
O modelo já está disponível na plataforma da Anthropic com o identificador claude-sonnet-5-5 e também na AWS, no Google Cloud e no Microsoft Azure, o que elimina a barreira de contrato para empresas que já consomem IA por um desses três hiperescaladores.
A conta chega aos contratos de serviços
O efeito mais direto não está nos laboratórios, e sim em quem vende horas de desenvolvimento. Nos Estados Unidos, empresas como Box e Zendesk já embutem o ganho de velocidade no produto; o cliente final recebe o ganho sem renegociar nada. Na Índia, onde TCS, Infosys e Wipro operam alguns dos maiores centros de entrega de software, um salto de 10,3% para 70,6% em programação agêntica num modelo intermediário pressiona contratos de preço fixo: o cliente sabe que o custo de produção caiu e vai pedir o desconto na renovação.
No Brasil, onde consultorias como a CI&T vendem squads de desenvolvimento para clientes americanos com base em custo e fuso horário, a vantagem de arbitragem encolhe quando o modelo intermediário faz a mesma tarefa por 30% menos. A exposição é comum aos dois países: quem precifica por hora trabalhada absorve a queda de custo como queda de receita, e quem precifica por resultado captura a margem.
A Anthropic manteve o preço por token justamente quando o custo por tarefa caiu. Para o comprador corporativo, a métrica de tabela deixou de ser um bom indicador do que se paga; o contrato que ainda compara fornecedores por preço por milhão de tokens está medindo a coisa errada.
Fontes
- anthropic.comhttps://www.anthropic.com/claude-sonnet-5-5
- claude.comhttps://claude.com/pricing
- marktechpost.comhttps://www.marktechpost.com/2026/09/28/anthropic-releases-claude-sonnet-5-5-70-6-on-terminal-bench-4-0-at-the-same-2-10-price/
- venturebeat.comhttps://venturebeat.com/technology/anthropic-launches-claude-sonnet-5-5-with-30-cost-reduction-per-task-due-to-faster-speeds-and-fewer-tool-calls