Anthropic lança Claude Opus 5 a US$ 5 por milhão de tokens, metade do custo do Fable 5

Lançado em 24 de julho, o Claude Opus 5 entrega desempenho próximo ao Fable 5 a US$ 5 por milhão de tokens de entrada, com controle de esforço em cinco níveis e janela de contexto de 1 milhão de tokens.
O posicionamento: inteligência near-frontier a metade do custo
A Anthropic lançou o Claude Opus 5 em 24 de julho com preço de US$ 5 por milhão de tokens de entrada e US$ 25 por saída. É o mesmo valor cobrado pelo Opus 4.8, mas com desempenho radicalmente distinto: no Frontier-Bench v0.1, benchmark interno para tarefas de raciocínio e automação, o Opus 5 dobrou a pontuação do Opus 4.8 ao mesmo custo. No CursorBench 3.2, voltado a coding assistido por LLM, chegou a 0,5% da pontuação máxima do Fable 5, modelo flagship da Anthropic que custa o dobro: US$ 10 de entrada e US$ 50 de saída por milhão de tokens.
A janela de contexto subiu para 1 milhão de tokens, com saída síncrona de até 128 mil tokens em uma única chamada de API. O momento é estratégico: o GPT-5.6 Terra, da OpenAI, foi lançado em 9 de julho, e o Gemini 2.5 Pro, da Google, já opera na mesma faixa de capacidade. O mid-tier tornou-se o campo de disputa real entre os fornecedores fechados de IA, porque é onde a maioria dos workloads enterprise vive em produção.
O mecanismo: o dial de esforço em cinco níveis
De "baixo" a "máximo", a API do Opus 5 calibra por requisição a profundidade do raciocínio. Tarefas de triagem, extração ou roteamento simples não precisam mobilizar o mesmo processamento de uma análise jurídica ou revisão de código. O modelo acrescenta um modo rápido a US$ 10 por milhão de tokens de entrada, 2,5 vezes mais veloz que o padrão, cache de prompts a US$ 0,50 por milhão de tokens e redução de 50% via Batch API.
Esse controle explícito de esforço por chamada não tem equivalente no GPT-5.6 Terra. Para desenvolvedores construindo agentes com centenas de etapas encadeadas, o ajuste entre "máximo" e "médio" nos passos intermediários pode representar 30% a 40% de redução no custo total de execução sem perda mensurável de qualidade nas saídas finais.
O que os parceiros de lançamento mediram
A Harvey, plataforma de IA jurídica usada pelos maiores escritórios de advocacia de Londres e Nova York, reportou 26% de redução no volume de tokens gerados em comparação ao Opus 4.8 em modo de raciocínio máximo, com qualidade equivalente aferida internamente. Em contratos jurídicos de alto volume, a diferença aparece diretamente no custo por dossiê.
O CEO da Zapier divulgou que o Opus 5 atingiu 100% de aprovação no AutomationBench interno da empresa, teste que simula fluxos de prevenção de churn do início ao fim com múltiplas ferramentas encadeadas. Versões anteriores, incluindo o Opus 4.8, não chegaram ao mesmo resultado nessa avaliação.
Dois mercados onde a equação de custo muda
Nos Estados Unidos, o lançamento comprime o mid-tier: a decisão de arquitetura passou a ser custo por tarefa, não posição em ranking de modelos. O GPT-5.6 Luna, mais barato a US$ 1 por milhão de tokens de entrada, não alcança a profundidade analítica do Opus 5. O Sol, flagship da mesma família OpenAI, custa mais e serve casos de uso distintos. Para integradores que faturaram a última geração de engajamentos em cima de Opus 4.8, o Opus 5 redefine o baseline de custo sem exigir mudança de fornecedor.
Na Índia, TCS, Infosys e HCL Technologies operam centros de desenvolvimento que usam Claude como backbone de automação enterprise para clientes europeus e norte-americanos. O controle de esforço por requisição altera a equação em projetos de grande escala: workloads de validação automática e triagem, que hoje consomem capacidade uniforme de inferência, passam a ser gerenciados por complexidade de tarefa. O custo de inferência deixa de ser constante e vira variável controlável nos P&Ls dos engajamentos, com impacto direto nas margens dos contratos de AI-as-a-service.
A Anthropic não divulgou projeções de adoção nem cronograma para versões seguintes do Opus. Os dados disponíveis são os de benchmark e os reportados pelos parceiros de lançamento.