OpenAI y Anthropic reducen precios el mismo día

El GPT-6 Sol bajó a US$ 2 por millón de tokens y el Claude Opus 5.5 a US$ 4, con anuncios realizados en horas distintas el 22 de septiembre.
OpenAI ha fijado el precio del GPT-6 Sol en US$ 2 por millón de tokens de entrada y US$ 10 en salida este martes, la mitad de lo que cobraba por el GPT-5.6 Sol, que era US$ 4 y US$ 20. El modelo menor de la dupla, el GPT-6 Luna, se ha fijado en US$ 0,10 y US$ 0,50, en comparación con US$ 0,20 y US$ 1,20 de la generación anterior. Un portavoz de la empresa comentó a VentureBeat que estos precios son permanentes, no una tarifa promocional de lanzamiento. En el mismo día, Anthropic lanzó el Claude Opus 5.5 a US$ 4 y US$ 20, en comparación con US$ 5 y US$ 25 del Opus 5.
Ambas reducciones se anunciaron con pocas horas de diferencia y atacan la misma línea del presupuesto: el caché. La lectura de caché del Opus 5.5 ha bajado a US$ 0,20 por millón de tokens, un 60% menos que los US$ 0,50 cobrados en el Opus 5, según la página de lanzamiento de Anthropic. Por parte de OpenAI, la entrada en caché también se mantiene en US$ 0,20 por millón, con una tarifa de escritura de US$ 2,50. Para quienes ejecutan agentes que reanotan el mismo contexto en cada paso, esta línea suele representar la mayor parte del gasto mensual, y no el precio de salida que aparece en los encabezados.
Qué ha cambiado en la hoja del comprador
En comparación con la propia Anthropic, el Claude Fable 5.1 sigue a US$ 10 y US$ 50 por millón de tokens, cinco veces el precio del Sol en ambas partes. El Gemini 3.8 Flash de Google opera a US$ 0,75 y US$ 3,75 en tarifa introductoria válida hasta el 31 de diciembre, y sube a US$ 1,50 y US$ 7,50 el 1 de enero de 2027. Quien elabore un presupuesto para 2027 con la tabla de hoy se equivocará en el cálculo del Google en un 100%.
Anthropic afirma que el Opus 5.5 genera salidas más de 30% más rápido que el Opus 5 y cuesta un 40% menos en cargas típicas en las configuraciones estándar. El 40% no proviene del precio de lista, que cayó un 20%, sino de la combinación de caché más barato con menos tokens de razonamiento por tarea. La distinción pesa en la renegociación del contrato: la reducción de la lista es contractual, la de 40% depende del perfil de uso de cada cliente y no se puede incluir en una cláusula.
El benchmark dejó de decidir
En el Artificial Analysis Coding Agent Index, el Sol obtuvo 80 puntos, por encima de los 77,2 del Claude Fable 5. En el OSWorld 2.0, Anthropic reporta un 81,8% de acierto del Opus 5.5 en tareas de uso de computadora. Son márgenes de pocos puntos, y OpenAI publicó el 8 de julio una auditoría que indica que cerca del 30% de las tareas del SWE-bench Pro contienen pruebas demasiado estrictas, enunciados incompletos o descripciones engañosas. Comprar un modelo según la puntuación de un benchmark, en este momento, es adquirir ruido estadístico.
Hay una lectura opuesta que merece ser mencionada: la de que el precio por token ha entrado en deflación estructural y seguirá cayendo. La tabla del Gemini 3.8 Flash desmiente eso en enero. Un precio de lanzamiento agresivo es un instrumento para ganar carga, y una carga que ya ha migrado resulta cara de revertir. Los US$ 2 del Sol valen hoy porque OpenAI los ha declarado permanentes, no porque la curva de costo de inferencia lo exija.
Dónde cambia la cuenta
Para las fábricas de software indias, el efecto es directo en el margen. TCS, Infosys y Cognizant venden mantenimiento de aplicaciones en contratos de precio cerrado fijados por cabeza, e integran herramientas ágiles en estos centros de entrega. Una inferencia 50% más barata mejora el margen del contrato actual y, en el siguiente ciclo, se convierte en un descuento exigido por el cliente en la renovación. El beneficio dura un ciclo de renegociación.
En Brasil, empresas como CI&T y los centros de servicios compartidos que atienden a clientes norteamericanos enfrentan la misma ecuación con un agravante cambiario: la API se factura en dólares y gran parte de los contratos locales están en reales. Un recorte del 50% en la lista en dólares no se traduce completamente en el P&L de quienes soportan el descasamiento.
En Alemania y en el resto de la Unión Europea, la decisión dejó de ser solo financiera. Desde el 2 de agosto de 2026 rigen las obligaciones del AI Act para modelos de propósito general, y cambiar de proveedor para capturar medio dólar por millón de tokens implica rehacer documentación técnica y evaluación de riesgos. El costo de cambio ha aumentado justo en el momento en que el incentivo para cambiar se ha vuelto mayor.
La variable que nadie publica es cuántos tokens quema un agente hasta completar una tarea. Mientras los proveedores compiten en el precio unitario y omiten el consumo, el comprador sigue careciendo del único número que cierra la cuenta.