Sonnet 5.5 de Anthropic: mismo precio, menos costos
El Sonnet 5.5 cuesta US$ 2/US$ 10 por millón de tokens, a mitad de precio que el Opus 5.5, y se posiciona a solo dos puntos en GDPval. Anthropic afirma que el costo por tarea disminuye hasta un 30%.

Anthropic lanzó este lunes (28) el Claude Sonnet 5.5 al mismo precio que el Sonnet 5: US$ 2 por millón de tokens de entrada y US$ 10 por millón de salida, con lectura de caché a US$ 0,20. El cambio está en el rendimiento. En el Terminal-Bench 4.0, prueba de programación agéntica, el modelo marca un 70,6%, en comparación con un 10,3% del anterior, según la página de lanzamiento de la empresa.
El dato que interesa a quienes compran IA a gran escala es otro. Anthropic afirma que el Sonnet 5.5 genera respuestas más de un 30% más rápido y cuesta hasta un 30% menos por tarea en sus pruebas, porque resuelve el trabajo con menos llamadas a la herramienta y menos tokens. El precio de lista se mantuvo; el costo efectivo disminuyó.
En la media, cerca del tope
La comparación con el Opus 5.5, el modelo más caro de la casa, explica el movimiento. El Opus 5.5 cuesta US$ 4 por millón de tokens de entrada y US$ 20 por millón de salida, el doble que el Sonnet 5.5 en ambos extremos, según la tabla oficial de precios. En el GDPval-AA v2.1, que mide trabajo de conocimiento, el Sonnet 5.5 suma 1.844 puntos Elo, frente a 1.846 del Opus 5.5 y 1.449 del Sonnet 5.
La distancia no es nula en todas las pruebas. En OSWorld 2.1, de uso de computadora, el Sonnet 5.5 se queda en un 80,1%, comparado con un 81,8% del Opus 5.5. En el Humanity's Last Exam con herramientas, la diferencia es mayor: 64,5% contra 67,7%. Para tareas de razonamiento prolongado, el modelo de gama alta aún ofrece algo que el intermedio no, y la propia Anthropic posiciona el Sonnet 5.5 para "tareas cotidianas bien delimitadas, corrección de errores y creación de documentos, presentaciones y hojas de cálculo".
Para un CIO, el cálculo se transforma. Si un flujo de análisis documental hoy opera en el Opus por falta de alternativas, la prueba obligatoria pasa a ser ejecutar el mismo lote en el Sonnet 5.5 y medir el costo por tarea completada, no el costo por token.
Lo que los clientes han medido
Los números de clientes publicados por Anthropic van en la misma dirección. Balyasny Asset Management reporta un rendimiento superior en 2.441 tareas de finanzas, con un consumo de tokens que cae de 497 mil a 121 mil por respuesta, una reducción de aproximadamente el 76%. Box dice que el modelo fue 2,4 veces más rápido que el Sonnet 5 en datos sensibles de finanzas y salud. Zendesk afirma que "los tickets fueron procesados un 20% más rápido".
Daniel Vogel, COO de Epic Games, mencionó que el Sonnet 5.5 "superó la misma vara de calidad que se esperaría de un modelo de categoría superior" en una auditoría de diseño de sistemas. Los testimonios de lanzamiento son seleccionados por el proveedor y miden casos favorables; sirven como hipótesis de prueba, no como un estándar independiente.
Salvaguardas cibernéticas del Opus
El Sonnet 5.5 llega con protecciones de ciberseguridad comparables a las del Opus 5.5. Solicitudes clasificadas como de mayor riesgo "recurrirán visiblemente al Sonnet 5", según Anthropic, y defensores que necesiten acceso ampliado pueden inscribirse en el Cyber Verification Program. Para equipos de seguridad ofensiva y red team, esto significa que parte del trabajo migrará, visiblemente, al modelo anterior, y el piloto debe medir esta tasa de retroceso antes de cualquier migración.
El modelo ya está disponible en la plataforma de Anthropic con el identificador claude-sonnet-5-5 y también en AWS, Google Cloud y Microsoft Azure, lo que elimina la barrera de contrato para empresas que ya consumen IA a través de uno de estos tres hiperescaladores.
El efecto en los contratos de servicios
El efecto más directo no está en los laboratorios, sino en quienes venden horas de desarrollo. En Estados Unidos, empresas como Box y Zendesk ya han incorporado la ganancia de velocidad en el producto; el cliente final recibe la mejora sin renegociar nada. En India, donde TCS, Infosys y Wipro operan algunos de los mayores centros de entrega de software, un salto del 10,3% al 70,6% en programación agéntica en un modelo intermedio presiona a los contratos de precio fijo: el cliente sabe que el costo de producción ha disminuido y solicitará el descuento en la renovación.
En Brasil, donde consultorías como CI&T venden squads de desarrollo a clientes estadounidenses basados en costo y zona horaria, la ventaja de arbitraje se reduce cuando el modelo intermedio realiza la misma tarea por un 30% menos. La exposición es común en ambos países: quienes fijan precios por hora trabajada absorben la caída del costo como una caída de ingresos, y quienes fijan precios por resultado capturan el margen.
Anthropic mantuvo el precio por token precisamente cuando el costo por tarea disminuyó. Para el comprador corporativo, la métrica de lista ha dejado de ser un buen indicador de lo que se paga; el contrato que aún compara proveedores por precio por millón de tokens está midiendo lo incorrecto.
Fuentes
- anthropic.comhttps://www.anthropic.com/claude-sonnet-5-5
- claude.comhttps://claude.com/pricing
- marktechpost.comhttps://www.marktechpost.com/2026/09/28/anthropic-releases-claude-sonnet-5-5-70-6-on-terminal-bench-4-0-at-the-same-2-10-price/
- venturebeat.comhttps://venturebeat.com/technology/anthropic-launches-claude-sonnet-5-5-with-30-cost-reduction-per-task-due-to-faster-speeds-and-fewer-tool-calls